we2app commited on
Commit
12ed0e8
·
verified ·
1 Parent(s): 797021e

Update Dockerfile

Browse files
Files changed (1) hide show
  1. Dockerfile +9 -7
Dockerfile CHANGED
@@ -10,17 +10,18 @@ RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/ge
10
  RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/mtp-gemma-4-E2B-it.gguf" -O /models/mtp-gemma-4-E2B-it.gguf
11
  RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/mmproj-F16.gguf" -O /models/gemma-4-E2B-it-mmproj.gguf
12
 
13
- # --- NEW MODEL: Gemma 3 270M IT Q8_0 (Swapped from F16) ---
14
  RUN wget "https://huggingface.co/unsloth/gemma-3-270m-it-GGUF/resolve/main/gemma-3-270m-it-Q8_0.gguf" -O /models/gemma-3-270m-it-Q8_0.gguf
15
 
16
- # --- MODEL 2: Gemma 3 1B Model ---
17
  RUN wget "https://huggingface.co/MaziyarPanahi/gemma-3-1b-it-GGUF/resolve/main/gemma-3-1b-it.Q3_K_M.gguf" -O /models/gemma-3-1b-it.Q3_K_M.gguf
18
 
19
- # --- MODEL 3: Ornith 1.0 9B Model ---
20
  RUN wget "https://huggingface.co/deepreinforce-ai/Ornith-1.0-9B-GGUF/resolve/main/ornith-1.0-9b-Q4_K_M.gguf" -O /models/ornith-1.0-9b-Q4_K_M.gguf
21
 
22
- # --- NEW MODEL 4: Qwen 3.5 0.8B Model ---
23
- RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/Qwen3.5-0.8B-Q4_K_M.gguf?download=true" -O /models/qwen-3.5-0.8b.gguf
 
24
 
25
  # --- CREATE ROUTER CONFIGURATION ---
26
  RUN echo "[gemma-4-E2B-it-vision]" > /models.ini && \
@@ -49,8 +50,9 @@ RUN echo "[gemma-4-E2B-it-vision]" > /models.ini && \
49
  echo "ctx-size = 8192" >> /models.ini && \
50
  echo "flash-attn = on" && \
51
  echo "" >> /models.ini && \
52
- echo "[qwen-3.5-0.8b]" >> /models.ini && \
53
- echo "model = /models/qwen-3.5-0.8b.gguf" >> /models.ini && \
 
54
  echo "ctx-size = 32768" >> /models.ini && \
55
  echo "flash-attn = on"
56
 
 
10
  RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/mtp-gemma-4-E2B-it.gguf" -O /models/mtp-gemma-4-E2B-it.gguf
11
  RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/mmproj-F16.gguf" -O /models/gemma-4-E2B-it-mmproj.gguf
12
 
13
+ # --- MODEL 2: Gemma 3 270M IT Q8_0 ---
14
  RUN wget "https://huggingface.co/unsloth/gemma-3-270m-it-GGUF/resolve/main/gemma-3-270m-it-Q8_0.gguf" -O /models/gemma-3-270m-it-Q8_0.gguf
15
 
16
+ # --- MODEL 3: Gemma 3 1B Model ---
17
  RUN wget "https://huggingface.co/MaziyarPanahi/gemma-3-1b-it-GGUF/resolve/main/gemma-3-1b-it.Q3_K_M.gguf" -O /models/gemma-3-1b-it.Q3_K_M.gguf
18
 
19
+ # --- MODEL 4: Ornith 1.0 9B Model ---
20
  RUN wget "https://huggingface.co/deepreinforce-ai/Ornith-1.0-9B-GGUF/resolve/main/ornith-1.0-9b-Q4_K_M.gguf" -O /models/ornith-1.0-9b-Q4_K_M.gguf
21
 
22
+ # --- MODEL 5: Qwen 3.5 0.8B Multimodal (Vision) ---
23
+ RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/Qwen3.5-0.8B-Q4_0.gguf" -O /models/Qwen3.5-0.8B-Q4_0.gguf
24
+ RUN wget "https://huggingface.co/unsloth/Qwen3.5-0.8B-GGUF/resolve/main/mmproj-BF16.gguf" -O /models/mmproj-BF16.gguf
25
 
26
  # --- CREATE ROUTER CONFIGURATION ---
27
  RUN echo "[gemma-4-E2B-it-vision]" > /models.ini && \
 
50
  echo "ctx-size = 8192" >> /models.ini && \
51
  echo "flash-attn = on" && \
52
  echo "" >> /models.ini && \
53
+ echo "[qwen-3.5-0.8b-vision]" >> /models.ini && \
54
+ echo "model = /models/Qwen3.5-0.8B-Q4_0.gguf" >> /models.ini && \
55
+ echo "mmproj = /models/mmproj-BF16.gguf" >> /models.ini && \
56
  echo "ctx-size = 32768" >> /models.ini && \
57
  echo "flash-attn = on"
58