| FROM python:3.10-slim | |
| # Установка системных зависимостей для компиляции llama-cpp | |
| RUN apt-get update && apt-get install -y \ | |
| build-essential \ | |
| cmake \ | |
| curl \ | |
| & \ | |
| rm -rf /var/lib/apt/lists/* | |
| # Создаем рабочую директорию | |
| WORKDIR /code | |
| # Устанавливаем FastAPI, Uvicorn и саму библиотеку llama-cpp-python | |
| RUN pip install --no-cache-dir fastapi uvicorn llama-cpp-python huggingface_hub | |
| # Скачиваем квантованную модель Gemma-4-E2B напрямую во внутреннюю папку | |
| RUN curl -L -o /code/model.gguf https://huggingface.co | |
| # Настройка прав пользователя (требование Hugging Face Spaces) | |
| RUN useradd -m -u 1000 user | |
| USER user | |
| ENV HOME=/home/user \ | |
| PATH=/home/user/.local/bin:$PATH | |
| # Копируем скрипт сервера (создадим его на следующем шаге) | |
| COPY --chown=user . /code | |
| EXPOSE 7860 | |
| # Запуск сервера | |
| CMD ["uvicorn", "app:app", "--host", "0.0.0.0", "--port", "7860"] | |