File size: 1,119 Bytes
1e8c0bb f97ca72 1e8c0bb f97ca72 1e8c0bb | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 | FROM python:3.10-slim
# Установка системных зависимостей для компиляции llama-cpp
RUN apt-get update && apt-get install -y \
build-essential \
cmake \
curl \
& \
rm -rf /var/lib/apt/lists/*
# Создаем рабочую директорию
WORKDIR /code
# Устанавливаем FastAPI, Uvicorn и саму библиотеку llama-cpp-python
RUN pip install --no-cache-dir fastapi uvicorn llama-cpp-python huggingface_hub
# Скачиваем квантованную модель Gemma-4-E2B напрямую во внутреннюю папку
RUN curl -L -o /code/model.gguf https://huggingface.co
# Настройка прав пользователя (требование Hugging Face Spaces)
RUN useradd -m -u 1000 user
USER user
ENV HOME=/home/user \
PATH=/home/user/.local/bin:$PATH
# Копируем скрипт сервера (создадим его на следующем шаге)
COPY --chown=user . /code
EXPOSE 7860
# Запуск сервера
CMD ["uvicorn", "app:app", "--host", "0.0.0.0", "--port", "7860"]
|