-
Notifications
You must be signed in to change notification settings - Fork 4
Expand file tree
/
Copy pathdocker-compose.yml
More file actions
60 lines (56 loc) · 1.77 KB
/
Copy pathdocker-compose.yml
File metadata and controls
60 lines (56 loc) · 1.77 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
version: '3.8'
services:
orchestrator:
build: ./services/orchestrator
ports:
- "4000:4000"
environment:
- FIREWORKS_API_KEY=${FIREWORKS_API_KEY}
- FIREWORKS_BASE_URL=${FIREWORKS_BASE_URL:-https://api.fireworks.ai/inference/v1}
- LOCAL_MODEL_URL=http://local-model-server:8000
- HIGH_CONFIDENCE_THRESHOLD=${HIGH_CONFIDENCE_THRESHOLD:-0.85}
- MEDIUM_CONFIDENCE_THRESHOLD=${MEDIUM_CONFIDENCE_THRESHOLD:-0.60}
- ENABLE_CACHE=${ENABLE_CACHE:-true}
- LOG_LEVEL=${LOG_LEVEL:-info}
- LOG_DB_PATH=/app/data/logs/tasks.db
- USE_HF_SERVERLESS=${USE_HF_SERVERLESS:-false}
- HF_TOKEN=${HF_TOKEN}
- MODEL_NAME=${MODEL_NAME:-google/gemma-3-12b-it}
volumes:
- ./input:/input:ro
- ./output:/output
- ./data:/app/data
depends_on:
local-model-server:
condition: service_healthy
local-model-server:
build:
context: ./services/local-model-server
args:
- BASE_IMAGE=${LOCAL_MODEL_BASE_IMAGE:-rocm/pytorch:rocm6.1_ubuntu22.04_py3.10_pytorch_2.4}
- INSTALL_HEAVY=${INSTALL_HEAVY:-true}
ports:
- "8000:8000"
environment:
- HSA_OVERRIDE_GFX_VERSION=${HSA_OVERRIDE_GFX_VERSION:-11.0.0}
- MODEL_NAME=${MODEL_NAME:-google/gemma-3-12b-it}
- HF_TOKEN=${HF_TOKEN}
- USE_HF_SERVERLESS=${USE_HF_SERVERLESS:-false}
volumes:
- model-cache:/root/.cache/huggingface
healthcheck:
test: ["CMD", "python", "-c", "import urllib.request; urllib.request.urlopen('http://localhost:8000/health')"]
interval: 30s
timeout: 10s
retries: 5
start_period: 120s
dashboard:
build: ./services/dashboard
ports:
- "3000:80"
depends_on:
- orchestrator
profiles:
- ui
volumes:
model-cache: