Spaces:
Sleeping
Sleeping
File size: 1,395 Bytes
766a31b 79258bc aab2631 e6bbc80 79258bc e6bbc80 aab2631 eefdc1f aab2631 79258bc c852864 79258bc 734ecb6 4d47d31 e6bbc80 79258bc eefdc1f 734ecb6 79258bc | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 | FROM python:3.11-slim
RUN apt-get update && apt-get install -y \
ffmpeg git git-lfs libsndfile1 libgl1 \
libglib2.0-0 wget espeak curl \
&& rm -rf /var/lib/apt/lists/*
WORKDIR /app
# Install uv (which provides uvx) — used by tribev2 for transcription
RUN curl -LsSf https://astral.sh/uv/install.sh | sh
ENV PATH="/root/.local/bin:$PATH"
RUN pip install --no-cache-dir \
torch==2.5.1 \
torchaudio==2.5.1 \
torchvision==0.20.1
COPY requirements.txt .
RUN pip install --no-cache-dir -r requirements.txt
# Pre-download whisperx model (public repo, no token needed)
# This avoids 429 rate limits when uvx whisperx runs at inference time
RUN python3 -c "from huggingface_hub import snapshot_download; snapshot_download('Systran/faster-whisper-large-v3', cache_dir='/tmp/hf_hub_cache')"
COPY . .
RUN useradd -m -u 1000 appuser && chown -R appuser:appuser /app
# Create shared HF cache directories
RUN mkdir -p /tmp/hf_hub_cache /tmp/whisper_cache && chown -R appuser:appuser /tmp/hf_hub_cache /tmp/whisper_cache
# Make uvx available to appuser
RUN cp /root/.local/bin/uvx /usr/local/bin/uvx 2>/dev/null || true
RUN cp /root/.local/bin/uv /usr/local/bin/uv 2>/dev/null || true
USER appuser
ENV CUDA_VISIBLE_DEVICES=""
ENV HF_TOKEN=${HF_TOKEN}
ENV TRIBE_CKPT=facebook/tribev2
ENV MAX_VIDEO_DURATION=120
ENV MAX_AUDIO_DURATION=120
EXPOSE 7860
CMD ["python", "app.py"]
|