Update Dockerfile
Browse files- Dockerfile +9 -1
Dockerfile
CHANGED
|
@@ -23,6 +23,9 @@ RUN wget "https://huggingface.co/deepreinforce-ai/Ornith-1.0-9B-GGUF/resolve/mai
|
|
| 23 |
RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/Qwen3.5-0.8B-Q4_0.gguf" -O /models/Qwen3.5-0.8B-Q4_0.gguf
|
| 24 |
RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/mmproj-BF16.gguf" -O /models/mmproj-BF16.gguf
|
| 25 |
|
|
|
|
|
|
|
|
|
|
| 26 |
# --- CREATE ROUTER CONFIGURATION ---
|
| 27 |
RUN echo "[gemma-4-E2B-it-vision]" > /models.ini && \
|
| 28 |
echo "model = /models/gemma-4-E2B-it-qat-UD-Q4_K_XL.gguf" >> /models.ini && \
|
|
@@ -48,12 +51,17 @@ RUN echo "[gemma-4-E2B-it-vision]" > /models.ini && \
|
|
| 48 |
echo "[ornith-9b]" >> /models.ini && \
|
| 49 |
echo "model = /models/ornith-1.0-9b-Q4_K_M.gguf" >> /models.ini && \
|
| 50 |
echo "ctx-size = 8192" >> /models.ini && \
|
| 51 |
-
echo "flash-attn = on" && \
|
| 52 |
echo "" >> /models.ini && \
|
| 53 |
echo "[qwen-3.5-0.8b-vision]" >> /models.ini && \
|
| 54 |
echo "model = /models/Qwen3.5-0.8B-Q4_0.gguf" >> /models.ini && \
|
| 55 |
echo "mmproj = /models/mmproj-BF16.gguf" >> /models.ini && \
|
| 56 |
echo "ctx-size = 32768" >> /models.ini && \
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 57 |
echo "flash-attn = on"
|
| 58 |
|
| 59 |
# --- START SERVER IN ROUTER MODE WITH CORS, TOOLS & MCP ENABLED ---
|
|
|
|
| 23 |
RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/Qwen3.5-0.8B-Q4_0.gguf" -O /models/Qwen3.5-0.8B-Q4_0.gguf
|
| 24 |
RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/mmproj-BF16.gguf" -O /models/mmproj-BF16.gguf
|
| 25 |
|
| 26 |
+
# --- MODEL 6: GPT OSS 20B (InternLM 2.5 20B Chat) ---
|
| 27 |
+
RUN wget "https://huggingface.co/MaziyarPanahi/InternLM2.5-20b-chat-GGUF/resolve/main/InternLM2.5-20b-chat.Q4_K_M.gguf" -O /models/internlm2_5-20b-chat.Q4_K_M.gguf
|
| 28 |
+
|
| 29 |
# --- CREATE ROUTER CONFIGURATION ---
|
| 30 |
RUN echo "[gemma-4-E2B-it-vision]" > /models.ini && \
|
| 31 |
echo "model = /models/gemma-4-E2B-it-qat-UD-Q4_K_XL.gguf" >> /models.ini && \
|
|
|
|
| 51 |
echo "[ornith-9b]" >> /models.ini && \
|
| 52 |
echo "model = /models/ornith-1.0-9b-Q4_K_M.gguf" >> /models.ini && \
|
| 53 |
echo "ctx-size = 8192" >> /models.ini && \
|
| 54 |
+
echo "flash-attn = on" >> /models.ini && \
|
| 55 |
echo "" >> /models.ini && \
|
| 56 |
echo "[qwen-3.5-0.8b-vision]" >> /models.ini && \
|
| 57 |
echo "model = /models/Qwen3.5-0.8B-Q4_0.gguf" >> /models.ini && \
|
| 58 |
echo "mmproj = /models/mmproj-BF16.gguf" >> /models.ini && \
|
| 59 |
echo "ctx-size = 32768" >> /models.ini && \
|
| 60 |
+
echo "flash-attn = on" >> /models.ini && \
|
| 61 |
+
echo "" >> /models.ini && \
|
| 62 |
+
echo "[gpt-oss-20b]" >> /models.ini && \
|
| 63 |
+
echo "model = /models/internlm2_5-20b-chat.Q4_K_M.gguf" >> /models.ini && \
|
| 64 |
+
echo "ctx-size = 32768" >> /models.ini && \
|
| 65 |
echo "flash-attn = on"
|
| 66 |
|
| 67 |
# --- START SERVER IN ROUTER MODE WITH CORS, TOOLS & MCP ENABLED ---
|