kirikir13 commited on
Commit
0bc4407
·
verified ·
1 Parent(s): d4d541b

Update prebuilt.sh

Browse files
Files changed (1) hide show
  1. prebuilt.sh +17 -7
prebuilt.sh CHANGED
@@ -1,13 +1,23 @@
1
  #!/bin/bash
2
  set -e
3
 
4
- echo "=== Building llama-cpp-python with CUDA for ZeroGPU ==="
5
- export CMAKE_ARGS="-DGGML_CUDA=on"
 
 
 
 
 
6
  export FORCE_CMAKE=1
 
 
 
 
 
7
 
8
- # The Gradio base image has CUDA 12.x installed.
9
- # Build llama-cpp-python from source so it links against the actual GPU toolkit.
10
- pip install --no-cache-dir llama-cpp-python
11
- pip install --no-cache-dir python-docx pdfplumber chardet
12
 
13
- echo "=== Build complete ==="
 
 
 
 
1
  #!/bin/bash
2
  set -e
3
 
4
+ echo "==============================================="
5
+ echo " Building llama-cpp-python with CUDA for ZeroGPU"
6
+ echo "==============================================="
7
+
8
+ # Your Space has CUDA 13.0.2 toolkit (visible in build logs).
9
+ # Build llama-cpp-python from source linked against it.
10
+ export CMAKE_ARGS="-DGGML_CUDA=on -DCMAKE_CUDA_ARCHITECTURES=native"
11
  export FORCE_CMAKE=1
12
+ export GGML_CUDA_FORCE_MMQ=on # force CUDA for all layers
13
+ export GGML_CUDA_FULL_TENSORS=on # use CUDA tensors throughout
14
+
15
+ echo "CMAKE_ARGS=$CMAKE_ARGS"
16
+ echo "FORCE_CMAKE=$FORCE_CMAKE"
17
 
18
+ pip install --no-cache-dir --no-build-isolation llama-cpp-python
 
 
 
19
 
20
+ echo ""
21
+ echo "==============================================="
22
+ echo " llama-cpp-python CUDA build complete!"
23
+ echo "==============================================="