FROM python:3.10-slim # Установка системных зависимостей для компиляции llama-cpp RUN apt-get update && apt-get install -y \ build-essential \ cmake \ curl \ & \ rm -rf /var/lib/apt/lists/* # Создаем рабочую директорию WORKDIR /code # Устанавливаем FastAPI, Uvicorn и саму библиотеку llama-cpp-python RUN pip install --no-cache-dir fastapi uvicorn llama-cpp-python huggingface_hub # Скачиваем квантованную модель Gemma-4-E2B напрямую во внутреннюю папку RUN curl -L -o /code/model.gguf https://huggingface.co # Настройка прав пользователя (требование Hugging Face Spaces) RUN useradd -m -u 1000 user USER user ENV HOME=/home/user \ PATH=/home/user/.local/bin:$PATH # Копируем скрипт сервера (создадим его на следующем шаге) COPY --chown=user . /code EXPOSE 7860 # Запуск сервера CMD ["uvicorn", "app:app", "--host", "0.0.0.0", "--port", "7860"]