#!/bin/bash export PYTHONUNBUFFERED=1 echo "🔥 [1/3] Démarrage du daemon Ollama natif CUDA..." ollama serve > /var/log/ollama_engine.log 2>&1 & echo "⏳ En attente de l'hyperviseur matérielle..." until curl -s http://localhost:11434/api/tags > /dev/null; do sleep 2 done echo "📥 [2/3] Vérification et chargement des modèles LLM locaux..." # Routine de téléchargement conditionnel (Évite la réinstallation) pull_if_missing() { local model_name=$1 if ollama list | grep -q "${model_name%:*}"; then echo " ✅ Modèle $model_name déjà présent en cache local. (Saut du téléchargement)" else echo " ⏳ Téléchargement du modèle $model_name (Cette opération n'aura lieu qu'une seule fois)..." ollama pull "$model_name" fi } # Fixation de l'infrastructure cognitive pull_if_missing "gemma4:e4b" pull_if_missing "qwen2.5:14b" echo "⚙️ [2.5/3] Alignement structurel : Protection du binaire ML..." echo "✅ Modèle statistique figé préservé." echo "🚀 [3/3] Démarrage du Centre de Commandement..." cd executives uvicorn api:app --host 0.0.0.0 --port 7860