we2app commited on
Commit
8371a0a
·
verified ·
1 Parent(s): 12ed0e8

Update Dockerfile

Browse files
Files changed (1) hide show
  1. Dockerfile +9 -1
Dockerfile CHANGED
@@ -23,6 +23,9 @@ RUN wget "https://huggingface.co/deepreinforce-ai/Ornith-1.0-9B-GGUF/resolve/mai
23
  RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/Qwen3.5-0.8B-Q4_0.gguf" -O /models/Qwen3.5-0.8B-Q4_0.gguf
24
  RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/mmproj-BF16.gguf" -O /models/mmproj-BF16.gguf
25
 
 
 
 
26
  # --- CREATE ROUTER CONFIGURATION ---
27
  RUN echo "[gemma-4-E2B-it-vision]" > /models.ini && \
28
  echo "model = /models/gemma-4-E2B-it-qat-UD-Q4_K_XL.gguf" >> /models.ini && \
@@ -48,12 +51,17 @@ RUN echo "[gemma-4-E2B-it-vision]" > /models.ini && \
48
  echo "[ornith-9b]" >> /models.ini && \
49
  echo "model = /models/ornith-1.0-9b-Q4_K_M.gguf" >> /models.ini && \
50
  echo "ctx-size = 8192" >> /models.ini && \
51
- echo "flash-attn = on" && \
52
  echo "" >> /models.ini && \
53
  echo "[qwen-3.5-0.8b-vision]" >> /models.ini && \
54
  echo "model = /models/Qwen3.5-0.8B-Q4_0.gguf" >> /models.ini && \
55
  echo "mmproj = /models/mmproj-BF16.gguf" >> /models.ini && \
56
  echo "ctx-size = 32768" >> /models.ini && \
 
 
 
 
 
57
  echo "flash-attn = on"
58
 
59
  # --- START SERVER IN ROUTER MODE WITH CORS, TOOLS & MCP ENABLED ---
 
23
  RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/Qwen3.5-0.8B-Q4_0.gguf" -O /models/Qwen3.5-0.8B-Q4_0.gguf
24
  RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/mmproj-BF16.gguf" -O /models/mmproj-BF16.gguf
25
 
26
+ # --- MODEL 6: GPT OSS 20B (InternLM 2.5 20B Chat) ---
27
+ RUN wget "https://huggingface.co/MaziyarPanahi/InternLM2.5-20b-chat-GGUF/resolve/main/InternLM2.5-20b-chat.Q4_K_M.gguf" -O /models/internlm2_5-20b-chat.Q4_K_M.gguf
28
+
29
  # --- CREATE ROUTER CONFIGURATION ---
30
  RUN echo "[gemma-4-E2B-it-vision]" > /models.ini && \
31
  echo "model = /models/gemma-4-E2B-it-qat-UD-Q4_K_XL.gguf" >> /models.ini && \
 
51
  echo "[ornith-9b]" >> /models.ini && \
52
  echo "model = /models/ornith-1.0-9b-Q4_K_M.gguf" >> /models.ini && \
53
  echo "ctx-size = 8192" >> /models.ini && \
54
+ echo "flash-attn = on" >> /models.ini && \
55
  echo "" >> /models.ini && \
56
  echo "[qwen-3.5-0.8b-vision]" >> /models.ini && \
57
  echo "model = /models/Qwen3.5-0.8B-Q4_0.gguf" >> /models.ini && \
58
  echo "mmproj = /models/mmproj-BF16.gguf" >> /models.ini && \
59
  echo "ctx-size = 32768" >> /models.ini && \
60
+ echo "flash-attn = on" >> /models.ini && \
61
+ echo "" >> /models.ini && \
62
+ echo "[gpt-oss-20b]" >> /models.ini && \
63
+ echo "model = /models/internlm2_5-20b-chat.Q4_K_M.gguf" >> /models.ini && \
64
+ echo "ctx-size = 32768" >> /models.ini && \
65
  echo "flash-attn = on"
66
 
67
  # --- START SERVER IN ROUTER MODE WITH CORS, TOOLS & MCP ENABLED ---