File size: 1,395 Bytes
766a31b
79258bc
 
aab2631
e6bbc80
79258bc
 
 
 
e6bbc80
 
 
 
aab2631
eefdc1f
 
 
aab2631
79258bc
 
 
c852864
 
 
 
79258bc
 
 
734ecb6
 
4d47d31
 
e6bbc80
 
79258bc
 
eefdc1f
 
 
 
 
734ecb6
79258bc
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
FROM python:3.11-slim

RUN apt-get update && apt-get install -y \
    ffmpeg git git-lfs libsndfile1 libgl1 \
    libglib2.0-0 wget espeak curl \
    && rm -rf /var/lib/apt/lists/*

WORKDIR /app

# Install uv (which provides uvx) — used by tribev2 for transcription
RUN curl -LsSf https://astral.sh/uv/install.sh | sh
ENV PATH="/root/.local/bin:$PATH"

RUN pip install --no-cache-dir \
    torch==2.5.1 \
    torchaudio==2.5.1 \
    torchvision==0.20.1

COPY requirements.txt .
RUN pip install --no-cache-dir -r requirements.txt

# Pre-download whisperx model (public repo, no token needed)
# This avoids 429 rate limits when uvx whisperx runs at inference time
RUN python3 -c "from huggingface_hub import snapshot_download; snapshot_download('Systran/faster-whisper-large-v3', cache_dir='/tmp/hf_hub_cache')"

COPY . .

RUN useradd -m -u 1000 appuser && chown -R appuser:appuser /app
# Create shared HF cache directories
RUN mkdir -p /tmp/hf_hub_cache /tmp/whisper_cache && chown -R appuser:appuser /tmp/hf_hub_cache /tmp/whisper_cache
# Make uvx available to appuser
RUN cp /root/.local/bin/uvx /usr/local/bin/uvx 2>/dev/null || true
RUN cp /root/.local/bin/uv /usr/local/bin/uv 2>/dev/null || true

USER appuser

ENV CUDA_VISIBLE_DEVICES=""
ENV HF_TOKEN=${HF_TOKEN}
ENV TRIBE_CKPT=facebook/tribev2
ENV MAX_VIDEO_DURATION=120
ENV MAX_AUDIO_DURATION=120

EXPOSE 7860
CMD ["python", "app.py"]