Skip to content

Commit d1b7388

Browse files
feat: updated LLM model versions and made them centrally configurable (#125)
1 parent a4517a4 commit d1b7388

6 files changed

Lines changed: 38 additions & 5 deletions

File tree

app/src/app_config.py

Lines changed: 16 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -63,6 +63,22 @@ def db_session(self) -> db.Session:
6363
rag_chunk_split_overlap: int = 50
6464
retrieval_top_k: int = 10
6565

66+
# LLM Model Configuration per pipeline
67+
default_openai_model_version: str = "gpt-5.1"
68+
default_openai_reasoning_level: str = "none"
69+
70+
generate_referrals_model_version: str = "gpt-5.1"
71+
generate_referrals_reasoning_level: str = "none"
72+
73+
generate_referrals_rag_model_version: str = "gpt-5.1"
74+
generate_referrals_rag_reasoning_level: str = "none"
75+
76+
generate_action_plan_model_version: str = "gpt-5.1"
77+
generate_action_plan_reasoning_level: str = "none"
78+
79+
generate_referrals_from_doc_model_version: str = "gpt-5.1"
80+
generate_referrals_from_doc_reasoning_level: str = "none"
81+
6682
def chroma_client(self) -> ClientAPI:
6783
return chromadb.HttpClient(host=self.rag_db_host, port=self.rag_db_port)
6884

app/src/common/components.py

Lines changed: 2 additions & 2 deletions
Original file line numberDiff line numberDiff line change
@@ -192,8 +192,8 @@ def run(
192192
self,
193193
messages: list[ChatMessage],
194194
domain: str | None = None,
195-
model: str = "gpt-5",
196-
reasoning_effort: str = "high",
195+
model: str = config.default_openai_model_version,
196+
reasoning_effort: str = config.default_openai_reasoning_level,
197197
) -> dict:
198198
"""
199199
Run the OpenAI web search generator.

app/src/pipelines/generate_action_plan/pipeline_wrapper.py

Lines changed: 5 additions & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -8,6 +8,7 @@
88
from opentelemetry.trace.status import Status, StatusCode
99
from pydantic import BaseModel
1010

11+
from src.app_config import config
1112
from src.common import haystack_utils, phoenix_utils
1213
from src.common.components import (
1314
LlmOutputValidator,
@@ -98,7 +99,10 @@ def _run(self, resource_objects: list[Resource], user_email: str, user_query: st
9899
"action_plan_json": action_plan_as_json,
99100
"user_query": user_query,
100101
},
101-
"llm": {"model": "gpt-5-mini", "reasoning_effort": "low"},
102+
"llm": {
103+
"model": config.generate_action_plan_model_version,
104+
"reasoning_effort": config.generate_action_plan_reasoning_level,
105+
},
102106
},
103107
include_outputs_from={"llm", "save_result"},
104108
)

app/src/pipelines/generate_referrals/pipeline_wrapper.py

Lines changed: 5 additions & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -15,6 +15,7 @@
1515
from opentelemetry.trace.status import Status, StatusCode
1616
from pydantic import BaseModel
1717

18+
from src.app_config import config
1819
from src.common import components, haystack_utils, phoenix_utils
1920

2021
logger = logging.getLogger(__name__)
@@ -154,5 +155,8 @@ def _run_arg_data(
154155
"query": query,
155156
"response_json": response_schema,
156157
},
157-
"llm": {"model": "gpt-5-mini", "reasoning_effort": "low"},
158+
"llm": {
159+
"model": config.generate_referrals_model_version,
160+
"reasoning_effort": config.generate_referrals_reasoning_level,
161+
},
158162
}

app/src/pipelines/generate_referrals_from_doc/pipeline_wrapper.py

Lines changed: 5 additions & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -11,6 +11,7 @@
1111
from openinference.instrumentation import _tracers, using_metadata
1212
from opentelemetry.trace.status import Status, StatusCode
1313

14+
from src.app_config import config
1415
from src.common import components, haystack_utils, phoenix_utils
1516
from src.pipelines.generate_referrals.pipeline_wrapper import response_schema
1617

@@ -95,7 +96,10 @@ def _run(self, files: List[UploadFile]) -> dict:
9596
"prompt_builder": {
9697
"response_json": response_schema,
9798
},
98-
"llm": {"model": "gpt-5-mini", "reasoning_effort": "low"},
99+
"llm": {
100+
"model": config.generate_referrals_from_doc_model_version,
101+
"reasoning_effort": config.generate_referrals_from_doc_reasoning_level,
102+
},
99103
},
100104
include_outputs_from={"llm"},
101105
)

app/src/pipelines/generate_referrals_rag/pipeline_wrapper.py

Lines changed: 5 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -84,4 +84,9 @@ def _run_arg_data(
8484
# For querying RAG DB
8585
"query_embedder": {"text": query},
8686
"retriever": {"top_k": config.retrieval_top_k, "filters": None},
87+
# Override LLM config for RAG pipeline
88+
"llm": {
89+
"model": config.generate_referrals_rag_model_version,
90+
"reasoning_effort": config.generate_referrals_rag_reasoning_level,
91+
},
8792
}

0 commit comments

Comments
 (0)