ingenium-expert-lms-3b-instruct-gguf / docker-compose.cpu.yml
ArnaudIngenium's picture
Paquet complet : harnais, docker-compose CPU, CLI, registres
3238f46 verified
Raw
History Blame Contribute Delete
1.42 kB
# Paquet de déploiement CPU Ingenium Expert LMS 3B Instruct — candidat Ollama.
#
# Variante de docker-compose.yml qui remplace vLLM/GPU par Ollama/CPU. Le
# harnais reste l'unique point d'entrée public (127.0.0.1:8080) ; Ollama
# reste sur le réseau interne du compose et n'est jamais joignable
# directement.
#
# Usage :
# GGUF_PATH=./ingenium-expert-lms-3b-instruct-grounded-v0.1.0-Q8_0.gguf docker compose -f docker-compose.cpu.yml up --build
#
# curl -X POST http://127.0.0.1:8080/ask \
# -H "Content-Type: application/json" \
# -d '{"question": "Comment créer un utilisateur ?", "context": {...context-v1...}}'
services:
ollama:
build:
context: .
dockerfile: docker/ollama/Dockerfile
environment:
MODEL_NAME: ingenium-expert-lms-3b-instruct
volumes:
- ${GGUF_PATH:?GGUF_PATH requis}:/model/model.gguf:ro
- ./deploy/ollama/Modelfile.ingenium-3b:/model/Modelfile:ro
healthcheck:
test: ["CMD-SHELL", "ollama list | grep -q \"$$MODEL_NAME\""]
interval: 10s
timeout: 5s
retries: 60
start_period: 120s
harness:
build:
context: .
dockerfile: harness/Dockerfile
environment:
VLLM_BASE_URL: http://ollama:11434/v1
MODEL_NAME: ingenium-expert-lms-3b-instruct
MAX_NEW_TOKENS: "128"
ports:
- "127.0.0.1:8080:8080"
depends_on:
ollama:
condition: service_healthy