proti0070 commited on
Commit
541af2c
·
verified ·
1 Parent(s): ade0283

Update Dockerfile

Browse files
Files changed (1) hide show
  1. Dockerfile +11 -5
Dockerfile CHANGED
@@ -1,15 +1,21 @@
1
  FROM ubuntu:22.04
2
 
3
  RUN apt-get update && apt-get install -y \
4
- build-essential cmake git curl wget python3 python3-pip \
5
  && rm -rf /var/lib/apt/lists/*
6
 
7
- # llama.cpp build
8
- RUN git clone https://github.com/ggerganov/llama.cpp /app/llama.cpp
9
  WORKDIR /app/llama.cpp
10
- RUN cmake -B build -DLLAMA_CURL=OFF && cmake --build build --config Release -j$(nproc)
11
 
12
- # Model download at build time
 
 
 
 
 
 
 
13
  RUN mkdir -p /app/models && \
14
  wget -q -O /app/models/qwen3-4b.gguf \
15
  "https://huggingface.co/bartowski/Qwen3-4B-GGUF/resolve/main/Qwen3-4B-Q4_K_M.gguf"
 
1
  FROM ubuntu:22.04
2
 
3
  RUN apt-get update && apt-get install -y \
4
+ build-essential cmake git wget \
5
  && rm -rf /var/lib/apt/lists/*
6
 
7
+ RUN git clone --depth=1 https://github.com/ggerganov/llama.cpp /app/llama.cpp
8
+
9
  WORKDIR /app/llama.cpp
 
10
 
11
+ RUN cmake -B build \
12
+ -DLLAMA_CURL=OFF \
13
+ -DLLAMA_BUILD_TESTS=OFF \
14
+ -DLLAMA_BUILD_EXAMPLES=OFF \
15
+ -DLLAMA_BUILD_SERVER=ON \
16
+ -DLLAMA_MTMD=OFF \
17
+ && cmake --build build --target llama-server -j$(nproc)
18
+
19
  RUN mkdir -p /app/models && \
20
  wget -q -O /app/models/qwen3-4b.gguf \
21
  "https://huggingface.co/bartowski/Qwen3-4B-GGUF/resolve/main/Qwen3-4B-Q4_K_M.gguf"