File size: 1,119 Bytes
1e8c0bb
f97ca72
1e8c0bb
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
f97ca72
 
 
1e8c0bb
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
FROM python:3.10-slim

# Установка системных зависимостей для компиляции llama-cpp
RUN apt-get update && apt-get install -y \
    build-essential \
    cmake \
    curl \
    & \
    rm -rf /var/lib/apt/lists/*

# Создаем рабочую директорию
WORKDIR /code

# Устанавливаем FastAPI, Uvicorn и саму библиотеку llama-cpp-python
RUN pip install --no-cache-dir fastapi uvicorn llama-cpp-python huggingface_hub

# Скачиваем квантованную модель Gemma-4-E2B напрямую во внутреннюю папку
RUN curl -L -o /code/model.gguf https://huggingface.co

# Настройка прав пользователя (требование Hugging Face Spaces)
RUN useradd -m -u 1000 user
USER user
ENV HOME=/home/user \
    PATH=/home/user/.local/bin:$PATH

# Копируем скрипт сервера (создадим его на следующем шаге)
COPY --chown=user . /code

EXPOSE 7860

# Запуск сервера
CMD ["uvicorn", "app:app", "--host", "0.0.0.0", "--port", "7860"]