Skip to content

Commit 56f133a

Browse files
committed
move model selection to the begining
1 parent 1fd6a80 commit 56f133a

1 file changed

Lines changed: 3 additions & 5 deletions

File tree

src/llm_service/llm_service.py

Lines changed: 3 additions & 5 deletions
Original file line numberDiff line numberDiff line change
@@ -12,7 +12,7 @@
1212
# from email.policy import default as email_policy
1313
import re
1414

15-
chosen_model = os.environ["CHOSEN_MODEL"]
15+
LLM_MODEL = os.getenv("LLM_MODEL", "llava:7b")
1616
if os.environ.get("MANUAL_TRACING"):
1717
span_processor_endpoint = os.environ.get("OTEL_ENDPOINT")
1818
if span_processor_endpoint is None:
@@ -34,9 +34,7 @@
3434
LangchainInstrumentor().instrument()
3535

3636
# Service name is required for most backends
37-
resource = Resource(
38-
attributes={SERVICE_NAME: f"LLM inference-{chosen_model.lower()}"}
39-
)
37+
resource = Resource(attributes={SERVICE_NAME: f"LLM inference-{LLM_MODEL.lower()}"})
4038

4139
trace_provider = TracerProvider(resource=resource)
4240
processor = BatchSpanProcessor(OTLPSpanExporter(endpoint=span_processor_endpoint))
@@ -54,7 +52,7 @@
5452
ollama_host = os.getenv("OLLAMA_HOST", "http://127.0.0.1:11434")
5553
if not ollama_host.startswith("http://") and not ollama_host.startswith("https://"):
5654
ollama_host = "http://" + ollama_host
57-
LLM_MODEL = os.getenv("LLM_MODEL", "llava:7b")
55+
# LLM_MODEL = os.getenv("LLM_MODEL", "llava:7b")
5856

5957
# create a single AsyncClient for reuse
6058
client = AsyncClient(host=ollama_host)

0 commit comments

Comments
 (0)