Spaces:
Sleeping
Sleeping
Defer model downloads to runtime to support gated models via HF_TOKEN
Browse files- Dockerfile +0 -11
Dockerfile
CHANGED
|
@@ -20,17 +20,6 @@ RUN pip install --no-cache-dir .
|
|
| 20 |
RUN mkdir -p /app/nltk_data && \
|
| 21 |
python -c "import nltk; nltk.download('punkt', download_dir='/app/nltk_data'); nltk.download('punkt_tab', download_dir='/app/nltk_data'); nltk.download('stopwords', download_dir='/app/nltk_data')"
|
| 22 |
|
| 23 |
-
# Pre-download HF embedding models at build time (download files only, no RAM loading)
|
| 24 |
-
RUN python -c "from huggingface_hub import snapshot_download; \
|
| 25 |
-
snapshot_download(repo_id='nomic-ai/nomic-embed-text-v1.5'); \
|
| 26 |
-
snapshot_download(repo_id='google/gemma-3n-embedding-exp'); \
|
| 27 |
-
snapshot_download(repo_id='Qwen/Qwen3-Embedding-0.6B')"
|
| 28 |
-
|
| 29 |
-
# Pre-download HF Qwen LLM model at build time (download files only, no RAM loading)
|
| 30 |
-
RUN python -c "from huggingface_hub import snapshot_download; \
|
| 31 |
-
snapshot_download(repo_id='Qwen/Qwen2.5-1.5B-Instruct')"
|
| 32 |
-
|
| 33 |
-
|
| 34 |
# Copy app code
|
| 35 |
COPY . .
|
| 36 |
|
|
|
|
| 20 |
RUN mkdir -p /app/nltk_data && \
|
| 21 |
python -c "import nltk; nltk.download('punkt', download_dir='/app/nltk_data'); nltk.download('punkt_tab', download_dir='/app/nltk_data'); nltk.download('stopwords', download_dir='/app/nltk_data')"
|
| 22 |
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 23 |
# Copy app code
|
| 24 |
COPY . .
|
| 25 |
|