Update Dockerfile
Browse files- Dockerfile +9 -7
Dockerfile
CHANGED
|
@@ -10,17 +10,18 @@ RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/ge
|
|
| 10 |
RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/mtp-gemma-4-E2B-it.gguf" -O /models/mtp-gemma-4-E2B-it.gguf
|
| 11 |
RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/mmproj-F16.gguf" -O /models/gemma-4-E2B-it-mmproj.gguf
|
| 12 |
|
| 13 |
-
# ---
|
| 14 |
RUN wget "https://huggingface.co/unsloth/gemma-3-270m-it-GGUF/resolve/main/gemma-3-270m-it-Q8_0.gguf" -O /models/gemma-3-270m-it-Q8_0.gguf
|
| 15 |
|
| 16 |
-
# --- MODEL
|
| 17 |
RUN wget "https://huggingface.co/MaziyarPanahi/gemma-3-1b-it-GGUF/resolve/main/gemma-3-1b-it.Q3_K_M.gguf" -O /models/gemma-3-1b-it.Q3_K_M.gguf
|
| 18 |
|
| 19 |
-
# --- MODEL
|
| 20 |
RUN wget "https://huggingface.co/deepreinforce-ai/Ornith-1.0-9B-GGUF/resolve/main/ornith-1.0-9b-Q4_K_M.gguf" -O /models/ornith-1.0-9b-Q4_K_M.gguf
|
| 21 |
|
| 22 |
-
# ---
|
| 23 |
-
RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/Qwen3.5-0.8B-
|
|
|
|
| 24 |
|
| 25 |
# --- CREATE ROUTER CONFIGURATION ---
|
| 26 |
RUN echo "[gemma-4-E2B-it-vision]" > /models.ini && \
|
|
@@ -49,8 +50,9 @@ RUN echo "[gemma-4-E2B-it-vision]" > /models.ini && \
|
|
| 49 |
echo "ctx-size = 8192" >> /models.ini && \
|
| 50 |
echo "flash-attn = on" && \
|
| 51 |
echo "" >> /models.ini && \
|
| 52 |
-
echo "[qwen-3.5-0.8b]" >> /models.ini && \
|
| 53 |
-
echo "model = /models/
|
|
|
|
| 54 |
echo "ctx-size = 32768" >> /models.ini && \
|
| 55 |
echo "flash-attn = on"
|
| 56 |
|
|
|
|
| 10 |
RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/mtp-gemma-4-E2B-it.gguf" -O /models/mtp-gemma-4-E2B-it.gguf
|
| 11 |
RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/mmproj-F16.gguf" -O /models/gemma-4-E2B-it-mmproj.gguf
|
| 12 |
|
| 13 |
+
# --- MODEL 2: Gemma 3 270M IT Q8_0 ---
|
| 14 |
RUN wget "https://huggingface.co/unsloth/gemma-3-270m-it-GGUF/resolve/main/gemma-3-270m-it-Q8_0.gguf" -O /models/gemma-3-270m-it-Q8_0.gguf
|
| 15 |
|
| 16 |
+
# --- MODEL 3: Gemma 3 1B Model ---
|
| 17 |
RUN wget "https://huggingface.co/MaziyarPanahi/gemma-3-1b-it-GGUF/resolve/main/gemma-3-1b-it.Q3_K_M.gguf" -O /models/gemma-3-1b-it.Q3_K_M.gguf
|
| 18 |
|
| 19 |
+
# --- MODEL 4: Ornith 1.0 9B Model ---
|
| 20 |
RUN wget "https://huggingface.co/deepreinforce-ai/Ornith-1.0-9B-GGUF/resolve/main/ornith-1.0-9b-Q4_K_M.gguf" -O /models/ornith-1.0-9b-Q4_K_M.gguf
|
| 21 |
|
| 22 |
+
# --- MODEL 5: Qwen 3.5 0.8B Multimodal (Vision) ---
|
| 23 |
+
RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/Qwen3.5-0.8B-Q4_0.gguf" -O /models/Qwen3.5-0.8B-Q4_0.gguf
|
| 24 |
+
RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/mmproj-BF16.gguf" -O /models/mmproj-BF16.gguf
|
| 25 |
|
| 26 |
# --- CREATE ROUTER CONFIGURATION ---
|
| 27 |
RUN echo "[gemma-4-E2B-it-vision]" > /models.ini && \
|
|
|
|
| 50 |
echo "ctx-size = 8192" >> /models.ini && \
|
| 51 |
echo "flash-attn = on" && \
|
| 52 |
echo "" >> /models.ini && \
|
| 53 |
+
echo "[qwen-3.5-0.8b-vision]" >> /models.ini && \
|
| 54 |
+
echo "model = /models/Qwen3.5-0.8B-Q4_0.gguf" >> /models.ini && \
|
| 55 |
+
echo "mmproj = /models/mmproj-BF16.gguf" >> /models.ini && \
|
| 56 |
echo "ctx-size = 32768" >> /models.ini && \
|
| 57 |
echo "flash-attn = on"
|
| 58 |
|