we2app commited on
Commit
e6f5bd6
·
verified ·
1 Parent(s): bf15c31

Update Dockerfile

Browse files
Files changed (1) hide show
  1. Dockerfile +5 -3
Dockerfile CHANGED
@@ -9,7 +9,9 @@ RUN mkdir -p /models
9
  RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/gemma-4-E2B-it-qat-UD-Q4_K_XL.gguf" -O /models/gemma-4-E2B-it-qat-UD-Q4_K_XL.gguf
10
  RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/mtp-gemma-4-E2B-it.gguf" -O /models/mtp-gemma-4-E2B-it.gguf
11
  RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/mmproj-F16.gguf" -O /models/gemma-4-E2B-it-mmproj.gguf
12
- RUN wget "https://huggingface.co/unsloth/gemma-3-270m-it-GGUF/resolve/main/gemma-3-270m-it-F16.gguf" -O /gemma-3-270m-it-F16.gguf
 
 
13
 
14
  # --- MODEL 2: Gemma 3 1B Model ---
15
  RUN wget "https://huggingface.co/MaziyarPanahi/gemma-3-1b-it-GGUF/resolve/main/gemma-3-1b-it.Q3_K_M.gguf" -O /models/gemma-3-1b-it.Q3_K_M.gguf
@@ -32,9 +34,9 @@ RUN echo "[gemma-4-vision]" > /models.ini && \
32
  echo "flash-attn = on" >> /models.ini && \
33
  echo "" >> /models.ini && \
34
  echo "[gemma-3-270m]" >> /models.ini && \
35
- echo "model = /models/gemma-3-270m-it-F16.gguf" >> /models.ini && \
36
  echo "ctx-size = 4096" >> /models.ini && \
37
- echo "flash-attn = on" >> /models.ini
38
 
39
  # --- START SERVER IN ROUTER MODE WITH TOOLS & MCP ENABLED ---
40
  CMD [ \
 
9
  RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/gemma-4-E2B-it-qat-UD-Q4_K_XL.gguf" -O /models/gemma-4-E2B-it-qat-UD-Q4_K_XL.gguf
10
  RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/mtp-gemma-4-E2B-it.gguf" -O /models/mtp-gemma-4-E2B-it.gguf
11
  RUN wget "https://huggingface.co/unsloth/gemma-4-E2B-it-qat-GGUF/resolve/main/mmproj-F16.gguf" -O /models/gemma-4-E2B-it-mmproj.gguf
12
+
13
+ # --- NEW MODEL: Gemma 3 270M IT Q8_0 (Swapped from F16) ---
14
+ RUN wget "https://huggingface.co/unsloth/gemma-3-270m-it-GGUF/resolve/main/gemma-3-270m-it-Q8_0.gguf" -O /models/gemma-3-270m-it-Q8_0.gguf
15
 
16
  # --- MODEL 2: Gemma 3 1B Model ---
17
  RUN wget "https://huggingface.co/MaziyarPanahi/gemma-3-1b-it-GGUF/resolve/main/gemma-3-1b-it.Q3_K_M.gguf" -O /models/gemma-3-1b-it.Q3_K_M.gguf
 
34
  echo "flash-attn = on" >> /models.ini && \
35
  echo "" >> /models.ini && \
36
  echo "[gemma-3-270m]" >> /models.ini && \
37
+ echo "model = /models/gemma-3-270m-it-Q8_0.gguf" >> /models.ini && \
38
  echo "ctx-size = 4096" >> /models.ini && \
39
+ echo "flash-attn = on"
40
 
41
  # --- START SERVER IN ROUTER MODE WITH TOOLS & MCP ENABLED ---
42
  CMD [ \