FROM python:3.10-slim WORKDIR /app # Устанавливаем базовые зависимости COPY requirements.txt . RUN pip install --no-cache-dir -r requirements.txt # Устанавливаем специальную версию llama-cpp для CPU, чтобы сервер не падал при сборке RUN pip install --no-cache-dir llama-cpp-python \ --extra-index-url https://abetlen.github.io/llama-cpp-python/whl/cpu # Копируем наш код COPY . . # Открываем порт 7860 (стандарт для Hugging Face) EXPOSE 7860 # Запускаем API-сервер CMD ["uvicorn", "app:app", "--host", "0.0.0.0", "--port", "7860"]