prereleasetrainingpackage / reports /project /step01_bootstrap_report.txt
ApacheOne's picture
Publish packed-Q1 native LoRA reproducibility release
bf45b91 verified
Raw
History Blame Contribute Delete
77.1 kB
================================================================================================================
NATIVE PACKED-Q1 LORA BOOTSTRAP
================================================================================================================
Started UTC: 2026-07-20T22:01:27Z
Repository URL: https://github.com/PrismML-Eng/llama.cpp.git
Required commit: 7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f
Repository directory: /content/Prism-llama.cpp
Build directory: /content/Prism-llama.cpp/build
Project directory: /content/prism_native_q1_lora
Model directory: /content/models/Bonsai-27B-Q1
Build jobs: 2
Python: 3.12.13 (main, Mar 4 2026, 09:23:07) [GCC 11.4.0]
Platform: Linux-6.6.122+-x86_64-with-glibc2.35
================================================================================================================
APT PACKAGE INDEX
================================================================================================================
COMMAND:
'apt-get' 'update' '-qq'
W: Skipping acquire of configured file 'main/source/Sources' as repository 'https://r2u.stat.illinois.edu/ubuntu jammy InRelease' does not seem to provide it (sources.list entry misspelt?)
RETURN CODE: 0
================================================================================================================
INSTALL BUILD DEPENDENCIES
================================================================================================================
COMMAND:
'apt-get' 'install' '-y' '-qq' 'build-essential' 'cmake' 'ninja-build' 'ccache' 'git' 'git-lfs' 'pkg-config' 'libssl-dev' 'libcurl4-openssl-dev' 'python3-dev'
Preconfiguring packages ...
(Reading database ...
(Reading database ... 5%
(Reading database ... 10%
(Reading database ... 15%
(Reading database ... 20%
(Reading database ... 25%
(Reading database ... 30%
(Reading database ... 35%
(Reading database ... 40%
(Reading database ... 45%
(Reading database ... 50%
(Reading database ... 55%
(Reading database ... 60%
(Reading database ... 65%
(Reading database ... 70%
(Reading database ... 75%
(Reading database ... 80%
(Reading database ... 85%
(Reading database ... 90%
(Reading database ... 95%
(Reading database ... 100%
(Reading database ... 122403 files and directories currently installed.)
Removing r-base-dev (4.6.0-4.2204.0) ...
dpkg: pkgconf: dependency problems, but removing anyway as you requested:
libsndfile1-dev:amd64 depends on pkg-config; however:
Package pkg-config is not installed.
Package pkgconf which provides pkg-config is to be removed.
libmkl-dev:amd64 depends on pkg-config; however:
Package pkg-config is not installed.
Package pkgconf which provides pkg-config is to be removed.
libglib2.0-dev:amd64 depends on pkg-config; however:
Package pkg-config is not installed.
Package pkgconf which provides pkg-config is to be removed.
libfontconfig-dev:amd64 depends on pkg-config; however:
Package pkg-config is not installed.
Package pkgconf which provides pkg-config is to be removed.
Removing pkgconf (1.8.0-1) ...
Removing 'diversion of /usr/bin/pkg-config to /usr/bin/pkg-config.real by pkgconf'
Removing 'diversion of /usr/share/aclocal/pkg.m4 to /usr/share/aclocal/pkg.real.m4 by pkgconf'
Removing 'diversion of /usr/share/man/man1/pkg-config.1.gz to /usr/share/man/man1/pkg-config.real.1.gz by pkgconf'
Removing 'diversion of /usr/share/pkg-config-crosswrapper to /usr/share/pkg-config-crosswrapper.real by pkgconf'
Selecting previously unselected package pkg-config.
(Reading database ...
(Reading database ... 5%
(Reading database ... 10%
(Reading database ... 15%
(Reading database ... 20%
(Reading database ... 25%
(Reading database ... 30%
(Reading database ... 35%
(Reading database ... 40%
(Reading database ... 45%
(Reading database ... 50%
(Reading database ... 55%
(Reading database ... 60%
(Reading database ... 65%
(Reading database ... 70%
(Reading database ... 75%
(Reading database ... 80%
(Reading database ... 85%
(Reading database ... 90%
(Reading database ... 95%
(Reading database ... 100%
(Reading database ... 122380 files and directories currently installed.)
Preparing to unpack .../pkg-config_0.29.2-1ubuntu3_amd64.deb ...
Unpacking pkg-config (0.29.2-1ubuntu3) ...
Preparing to unpack .../libpython3.10-dev_3.10.12-1~22.04.16_amd64.deb ...
Unpacking libpython3.10-dev:amd64 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ...
Preparing to unpack .../libpython3.10_3.10.12-1~22.04.16_amd64.deb ...
Unpacking libpython3.10:amd64 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ...
Preparing to unpack .../libssl-dev_3.0.2-0ubuntu1.25_amd64.deb ...
Unpacking libssl-dev:amd64 (3.0.2-0ubuntu1.25) over (3.0.2-0ubuntu1.23) ...
Preparing to unpack .../libssl3_3.0.2-0ubuntu1.25_amd64.deb ...
Unpacking libssl3:amd64 (3.0.2-0ubuntu1.25) over (3.0.2-0ubuntu1.23) ...
Setting up libssl3:amd64 (3.0.2-0ubuntu1.25) ...
(Reading database ...
(Reading database ... 5%
(Reading database ... 10%
(Reading database ... 15%
(Reading database ... 20%
(Reading database ... 25%
(Reading database ... 30%
(Reading database ... 35%
(Reading database ... 40%
(Reading database ... 45%
(Reading database ... 50%
(Reading database ... 55%
(Reading database ... 60%
(Reading database ... 65%
(Reading database ... 70%
(Reading database ... 75%
(Reading database ... 80%
(Reading database ... 85%
(Reading database ... 90%
(Reading database ... 95%
(Reading database ... 100%
(Reading database ... 122395 files and directories currently installed.)
Preparing to unpack .../00-python3.10_3.10.12-1~22.04.16_amd64.deb ...
Unpacking python3.10 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ...
Preparing to unpack .../01-libpython3.10-stdlib_3.10.12-1~22.04.16_amd64.deb ...
Unpacking libpython3.10-stdlib:amd64 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ...
Preparing to unpack .../02-python3.10-minimal_3.10.12-1~22.04.16_amd64.deb ...
Unpacking python3.10-minimal (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ...
Preparing to unpack .../03-libpython3.10-minimal_3.10.12-1~22.04.16_amd64.deb ...
Unpacking libpython3.10-minimal:amd64 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ...
Selecting previously unselected package libhiredis0.14:amd64.
Preparing to unpack .../04-libhiredis0.14_0.14.1-2_amd64.deb ...
Unpacking libhiredis0.14:amd64 (0.14.1-2) ...
Selecting previously unselected package ccache.
Preparing to unpack .../05-ccache_4.5.1-1_amd64.deb ...
Unpacking ccache (4.5.1-1) ...
Preparing to unpack .../06-libcurl4-openssl-dev_7.81.0-1ubuntu1.25_amd64.deb ...
Unpacking libcurl4-openssl-dev:amd64 (7.81.0-1ubuntu1.25) over (7.81.0-1ubuntu1.24) ...
Preparing to unpack .../07-curl_7.81.0-1ubuntu1.25_amd64.deb ...
Unpacking curl (7.81.0-1ubuntu1.25) over (7.81.0-1ubuntu1.24) ...
Preparing to unpack .../08-libcurl4_7.81.0-1ubuntu1.25_amd64.deb ...
Unpacking libcurl4:amd64 (7.81.0-1ubuntu1.25) over (7.81.0-1ubuntu1.24) ...
Selecting previously unselected package git-lfs.
Preparing to unpack .../09-git-lfs_3.0.2-1ubuntu0.3_amd64.deb ...
Unpacking git-lfs (3.0.2-1ubuntu0.3) ...
Selecting previously unselected package javascript-common.
Preparing to unpack .../10-javascript-common_11+nmu1_all.deb ...
Unpacking javascript-common (11+nmu1) ...
Selecting previously unselected package libjs-underscore.
Preparing to unpack .../11-libjs-underscore_1.13.2~dfsg-2_all.deb ...
Unpacking libjs-underscore (1.13.2~dfsg-2) ...
Selecting previously unselected package libjs-sphinxdoc.
Preparing to unpack .../12-libjs-sphinxdoc_4.3.2-1_all.deb ...
Unpacking libjs-sphinxdoc (4.3.2-1) ...
Selecting previously unselected package ninja-build.
Preparing to unpack .../13-ninja-build_1.10.1-1_amd64.deb ...
Unpacking ninja-build (1.10.1-1) ...
Selecting previously unselected package python3.10-dev.
Preparing to unpack .../14-python3.10-dev_3.10.12-1~22.04.16_amd64.deb ...
Unpacking python3.10-dev (3.10.12-1~22.04.16) ...
Selecting previously unselected package python3-dev.
Preparing to unpack .../15-python3-dev_3.10.6-1~22.04.1_amd64.deb ...
Unpacking python3-dev (3.10.6-1~22.04.1) ...
Preparing to unpack .../16-r-base-core_4.6.1-1.2204.1_amd64.deb ...
Unpacking r-base-core (4.6.1-1.2204.1) over (4.6.0-4.2204.0) ...
Setting up javascript-common (11+nmu1) ...
Setting up ninja-build (1.10.1-1) ...
Setting up libssl-dev:amd64 (3.0.2-0ubuntu1.25) ...
Setting up libpython3.10-minimal:amd64 (3.10.12-1~22.04.16) ...
Setting up pkg-config (0.29.2-1ubuntu3) ...
Setting up libcurl4:amd64 (7.81.0-1ubuntu1.25) ...
Setting up curl (7.81.0-1ubuntu1.25) ...
Setting up git-lfs (3.0.2-1ubuntu0.3) ...
Setting up libjs-underscore (1.13.2~dfsg-2) ...
Setting up libhiredis0.14:amd64 (0.14.1-2) ...
Setting up ccache (4.5.1-1) ...
Updating symlinks in /usr/lib/ccache ...
Setting up python3.10-minimal (3.10.12-1~22.04.16) ...
Setting up libpython3.10-stdlib:amd64 (3.10.12-1~22.04.16) ...
Setting up libcurl4-openssl-dev:amd64 (7.81.0-1ubuntu1.25) ...
Setting up r-base-core (4.6.1-1.2204.1) ...
Installing new version of config file /etc/R/Makeconf ...
Setting up libjs-sphinxdoc (4.3.2-1) ...
Setting up libpython3.10:amd64 (3.10.12-1~22.04.16) ...
Setting up python3.10 (3.10.12-1~22.04.16) ...
Setting up libpython3.10-dev:amd64 (3.10.12-1~22.04.16) ...
Setting up python3.10-dev (3.10.12-1~22.04.16) ...
Setting up python3-dev (3.10.6-1~22.04.1) ...
Processing triggers for hicolor-icon-theme (0.17-2) ...
Processing triggers for libc-bin (2.35-0ubuntu3.8) ...
/sbin/ldconfig.real: /usr/local/lib/libumf.so.1 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libtbbmalloc.so.2 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libur_adapter_level_zero_v2.so.0 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libtbbbind_2_5.so.3 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libur_adapter_level_zero.so.0 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libur_adapter_opencl.so.0 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libtbbmalloc_proxy.so.2 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libur_loader.so.0 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libtbbbind.so.3 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libtcm_debug.so.1 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libhwloc.so.15 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libtbb.so.12 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libtbbbind_2_0.so.3 is not a symbolic link
/sbin/ldconfig.real: /usr/local/lib/libtcm.so.1 is not a symbolic link
Processing triggers for man-db (2.10.2-1) ...
Processing triggers for mailcap (3.70+nmu1ubuntu1) ...
RETURN CODE: 0
================================================================================================================
INSTALL PYTHON DOWNLOAD DEPENDENCIES
================================================================================================================
COMMAND:
'/usr/bin/python3' '-m' 'pip' 'install' '-q' '--upgrade' 'huggingface_hub' 'hf_transfer' 'safetensors'
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━ 771.9/771.9 kB 46.1 MB/s eta 0:00:00
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━ 3.6/3.6 MB 125.4 MB/s eta 0:00:00
RETURN CODE: 0
================================================================================================================
CUDA ENVIRONMENT
================================================================================================================
PyTorch version: 2.11.0+cu128
PyTorch CUDA version: 12.8
CUDA device index: 0
CUDA device name: NVIDIA L4
CUDA compute capability: 8.9
CMake CUDA architecture: 89
Total VRAM: 22.034 GiB
NVIDIA-SMI:
Mon Jul 20 22:02:07 2026
+-----------------------------------------------------------------------------------------+
| NVIDIA-SMI 580.82.07 Driver Version: 580.82.07 CUDA Version: 13.0 |
+-----------------------------------------+------------------------+----------------------+
| GPU Name Persistence-M | Bus-Id Disp.A | Volatile Uncorr. ECC |
| Fan Temp Perf Pwr:Usage/Cap | Memory-Usage | GPU-Util Compute M. |
| | | MIG M. |
|=========================================+========================+======================|
| 0 NVIDIA L4 Off | 00000000:00:03.0 Off | 0 |
| N/A 36C P8 14W / 72W | 3MiB / 23034MiB | 0% Default |
| | | N/A |
+-----------------------------------------+------------------------+----------------------+
+-----------------------------------------------------------------------------------------+
| Processes: |
| GPU GI CI PID Type Process name GPU Memory |
| ID ID Usage |
|=========================================================================================|
| No running processes found |
+-----------------------------------------------------------------------------------------+
NVIDIA-SMI return code: 0
NVCC:
nvcc: NVIDIA (R) Cuda compiler driver
Copyright (c) 2005-2025 NVIDIA Corporation
Built on Fri_Feb_21_20:23:50_PST_2025
Cuda compilation tools, release 12.8, V12.8.93
Build cuda_12.8.r12.8/compiler.35583870_0
NVCC return code: 0
================================================================================================================
CONFIGURE CCACHE
================================================================================================================
COMMAND:
'ccache' '--max-size' '10G'
Set cache size limit to 10.0 GB
RETURN CODE: 0
================================================================================================================
INITIALIZE PRISM REPOSITORY
================================================================================================================
COMMAND:
'git' 'init' '/content/Prism-llama.cpp'
hint: Using 'master' as the name for the initial branch. This default branch name
hint: is subject to change. To configure the initial branch name to use in all
hint: of your new repositories, which will suppress this warning, call:
hint:
hint: git config --global init.defaultBranch <name>
hint:
hint: Names commonly chosen instead of 'master' are 'main', 'trunk' and
hint: 'development'. The just-created branch can be renamed via this command:
hint:
hint: git branch -m <name>
Initialized empty Git repository in /content/Prism-llama.cpp/.git/
RETURN CODE: 0
================================================================================================================
ADD PRISM REMOTE
================================================================================================================
COMMAND:
'git' '-C' '/content/Prism-llama.cpp' 'remote' 'add' 'origin' 'https://github.com/PrismML-Eng/llama.cpp.git'
RETURN CODE: 0
================================================================================================================
FETCH EXACT PRISM COMMIT
================================================================================================================
COMMAND:
'git' '-C' '/content/Prism-llama.cpp' 'fetch' '--depth' '1' 'origin' '7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f'
From https://github.com/PrismML-Eng/llama.cpp
* branch 7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f -> FETCH_HEAD
RETURN CODE: 0
================================================================================================================
CHECK OUT EXACT PRISM COMMIT
================================================================================================================
COMMAND:
'git' '-C' '/content/Prism-llama.cpp' 'checkout' '--detach' 'FETCH_HEAD'
HEAD is now at 7529fda force qwen35 to treat IGPU like a GPU so DSpark does not fall back to CPU (#88)
RETURN CODE: 0
================================================================================================================
SOURCE CHECKOUT
================================================================================================================
Resolved commit: 7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f
Detached checkout: True
Working tree clean: True
Commit information:
commit 7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f
Author: Thad Reber <thad.reber@gmail.com>
AuthorDate: Sun Jul 19 23:50:54 2026 -0700
Commit: GitHub <noreply@github.com>
CommitDate: Sun Jul 19 23:50:54 2026 -0700
force qwen35 to treat IGPU like a GPU so DSpark does not fall back to CPU (#88)
================================================================================================================
CMAKE CONFIGURATION
================================================================================================================
COMMAND:
'cmake' '-S' '/content/Prism-llama.cpp' '-B' '/content/Prism-llama.cpp/build' '-G' 'Ninja' '-DCMAKE_BUILD_TYPE=Release' '-DGGML_CUDA=ON' '-DCMAKE_CUDA_ARCHITECTURES=89' '-DLLAMA_BUILD_COMMON=ON' '-DLLAMA_BUILD_EXAMPLES=ON' '-DLLAMA_BUILD_TOOLS=ON' '-DLLAMA_BUILD_SERVER=ON' '-DLLAMA_BUILD_TESTS=ON' '-DBUILD_TESTING=ON' '-DLLAMA_BUILD_UI=OFF' '-DLLAMA_FATAL_WARNINGS=OFF' '-DGGML_CCACHE=ON' '-DLLAMA_OPENSSL=ON'
-- The C compiler identification is GNU 11.4.0
-- The CXX compiler identification is GNU 11.4.0
-- Detecting C compiler ABI info
-- Detecting C compiler ABI info - done
-- Check for working C compiler: /usr/bin/cc - skipped
-- Detecting C compile features
-- Detecting C compile features - done
-- Detecting CXX compiler ABI info
-- Detecting CXX compiler ABI info - done
-- Check for working CXX compiler: /usr/bin/c++ - skipped
-- Detecting CXX compile features
-- Detecting CXX compile features - done
CMAKE_BUILD_TYPE=Release
-- Found Git: /usr/bin/git (found version "2.34.1")
-- The ASM compiler identification is GNU
-- Found assembler: /usr/bin/cc
-- Performing Test CMAKE_HAVE_LIBC_PTHREAD
-- Performing Test CMAKE_HAVE_LIBC_PTHREAD - Success
-- Found Threads: TRUE
-- ccache found, compilation results will be cached. Disable with GGML_CCACHE=OFF.
-- CMAKE_SYSTEM_PROCESSOR: x86_64
-- GGML_SYSTEM_ARCH: x86
-- Found OpenMP_C: -fopenmp (found version "4.5")
-- Found OpenMP_CXX: -fopenmp (found version "4.5")
-- Found OpenMP: TRUE (found version "4.5")
-- Including CPU backend
-- x86 detected
-- Adding CPU backend variant ggml-cpu: -march=native
-- Found CUDAToolkit: /usr/local/cuda/targets/x86_64-linux/include (found version "12.8.93")
-- CUDA Toolkit found
-- The CUDA compiler identification is NVIDIA 12.8.93 with host compiler GNU 11.4.0
-- Detecting CUDA compiler ABI info
-- Detecting CUDA compiler ABI info - done
-- Check for working CUDA compiler: /usr/local/cuda/bin/nvcc - skipped
-- Detecting CUDA compile features
-- Detecting CUDA compile features - done
-- Using CMAKE_CUDA_ARCHITECTURES=89 CMAKE_CUDA_ARCHITECTURES_NATIVE=89-real
-- Found NCCL: /usr/lib/x86_64-linux-gnu/libnccl.so
-- CUDA host compiler is GNU 11.4.0
-- Including CUDA backend
-- ggml version: 0.13.1
-- ggml commit: 7529fda
-- Found OpenSSL: /usr/lib/x86_64-linux-gnu/libcrypto.so (found version "3.0.2")
-- Performing Test OPENSSL_VERSION_SUPPORTED
-- Performing Test OPENSSL_VERSION_SUPPORTED - Success
-- OpenSSL found: 3.0.2
-- Generating embedded license file for target: llama-app
-- Configuring done (5.2s)
-- Generating done (0.2s)
-- Build files have been written to: /content/Prism-llama.cpp/build
RETURN CODE: 0
================================================================================================================
REQUIRED BUILD TARGETS
================================================================================================================
[FOUND] llama-cli
[FOUND] llama-completion
[FOUND] llama-server
[FOUND] llama-finetune
[FOUND] llama-export-lora
[FOUND] test-backend-ops
================================================================================================================
BUILD PRISM CUDA TARGETS
================================================================================================================
COMMAND:
'cmake' '--build' '/content/Prism-llama.cpp/build' '--parallel' '2' '--target' 'llama-cli' 'llama-completion' 'llama-server' 'llama-finetune' 'llama-export-lora' 'test-backend-ops'
[1/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml.cpp.o
[2/451] Building C object ggml/src/CMakeFiles/ggml-base.dir/ggml-alloc.c.o
[3/451] Building C object ggml/src/CMakeFiles/ggml-base.dir/ggml.c.o
[4/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml-backend.cpp.o
[5/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml-opt.cpp.o
[6/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml-threading.cpp.o
[7/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml-backend-meta.cpp.o
[8/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/gguf.cpp.o
[9/451] Building C object ggml/src/CMakeFiles/ggml-base.dir/ggml-quants.c.o
[10/451] Linking CXX shared library bin/libggml-base.so.0.13.1
[11/451] Creating library symlink bin/libggml-base.so.0 bin/libggml-base.so
[12/451] Building CXX object ggml/src/CMakeFiles/ggml.dir/ggml-backend-dl.cpp.o
[13/451] Building CXX object ggml/src/CMakeFiles/ggml.dir/ggml-backend-reg.cpp.o
[14/451] Building C object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/ggml-cpu.c.o
[15/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/ggml-cpu.cpp.o
[16/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/hbm.cpp.o
[17/451] Building C object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/quants.c.o
[18/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/traits.cpp.o
[19/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/amx/amx.cpp.o
[20/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/amx/mmq.cpp.o
[21/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/repack.cpp.o
[22/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/binary-ops.cpp.o
[23/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/vec.cpp.o
[24/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/unary-ops.cpp.o
[25/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/llamafile/sgemm.cpp.o
[26/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/ops.cpp.o
[27/451] Building C object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/arch/x86/quants.c.o
[28/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/acc.cu.o
[29/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/arch/x86/repack.cpp.o
[30/451] Linking CXX shared library bin/libggml-cpu.so.0.13.1
[31/451] Creating library symlink bin/libggml-cpu.so.0 bin/libggml-cpu.so
[32/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/add-id.cu.o
[33/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/allreduce.cu.o
[34/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/arange.cu.o
[35/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/argmax.cu.o
[36/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/binbcast.cu.o
[37/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/clamp.cu.o
[38/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/concat.cu.o
[39/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/conv-transpose-1d.cu.o
[40/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/conv2d-dw.cu.o
[41/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/argsort.cu.o
[42/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/conv2d-transpose.cu.o
[43/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/conv2d.cu.o
[44/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/convert.cu.o
[45/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/count-equal.cu.o
[46/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/cross-entropy-loss.cu.o
[47/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/cpy.cu.o
[48/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/diag.cu.o
[49/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/cumsum.cu.o
[50/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/diagmask.cu.o
[51/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fattn-tile.cu.o
[52/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fattn-wmma-f16.cu.o
[53/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fill.cu.o
[54/451] Building CXX object src/CMakeFiles/llama.dir/llama-memory.cpp.o
[55/451] Building CXX object src/CMakeFiles/llama.dir/llama-memory-hybrid.cpp.o
[56/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fwht.cu.o
[57/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/gated_delta_net.cu.o
[58/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fattn.cu.o
[59/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/getrows.cu.o
[60/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/ggml-cuda.cu.o
[61/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/gla.cu.o
[62/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/im2col.cu.o
[63/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmf.cu.o
[64/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mean.cu.o
[65/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmid.cu.o
[66/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmq-hopper-q1.cu.o
[67/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmvf.cu.o
[68/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmq.cu.o
[69/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/norm.cu.o
[70/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/opt-step-adamw.cu.o
[71/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/opt-step-sgd.cu.o
[72/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/out-prod.cu.o
[73/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/pad.cu.o
[74/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/pad_reflect_1d.cu.o
[75/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/pool2d.cu.o
[76/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmvq.cu.o
[77/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/quantize.cu.o
[78/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/roll.cu.o
[79/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/scale.cu.o
[80/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/rope.cu.o
[81/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/set.cu.o
[82/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/set-rows.cu.o
[83/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/snake.cu.o
[84/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/softcap.cu.o
[85/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/softmax.cu.o
[86/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/solve_tri.cu.o
[87/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/ssm-conv.cu.o
[88/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/ssm-scan.cu.o
[89/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/sum.cu.o
[90/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/sumrows.cu.o
[91/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/top-k.cu.o
[92/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/topk-moe.cu.o
[93/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/tri.cu.o
[94/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/tsembd.cu.o
[95/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/upscale.cu.o
[96/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/unary.cu.o
[97/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/wkv.cu.o
[98/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq112-dv112.cu.o
[99/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq192-dv128.cu.o
[100/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq128-dv128.cu.o
[101/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq320-dv256.cu.o
[102/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq40-dv40.cu.o
[103/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq512-dv512.cu.o
[104/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq256-dv256.cu.o
[105/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq576-dv512.cu.o
[106/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq64-dv64.cu.o
[107/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq72-dv72.cu.o
[108/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq80-dv80.cu.o
[109/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_1-ncols2_16.cu.o
[110/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq96-dv96.cu.o
[111/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_1-ncols2_32.cu.o
[112/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_1-ncols2_8.cu.o
[113/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_16-ncols2_1.cu.o
[114/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_16-ncols2_2.cu.o
[115/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_2-ncols2_16.cu.o
[116/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_2-ncols2_32.cu.o
[117/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_16-ncols2_4.cu.o
[118/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_2-ncols2_4.cu.o
[119/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_2-ncols2_8.cu.o
[120/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_32-ncols2_2.cu.o
[121/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_32-ncols2_1.cu.o
[122/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_4-ncols2_16.cu.o
[123/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_4-ncols2_2.cu.o
[124/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_4-ncols2_4.cu.o
[125/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_4-ncols2_8.cu.o
[126/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_64-ncols2_1.cu.o
[127/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_8-ncols2_1.cu.o
[128/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_8-ncols2_2.cu.o
[129/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_8-ncols2_4.cu.o
[130/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_8-ncols2_8.cu.o
[131/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq1_s.cu.o
[132/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq2_s.cu.o
[133/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq2_xs.cu.o
[134/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq2_xxs.cu.o
[135/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq3_s.cu.o
[136/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq3_xxs.cu.o
[137/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq4_nl.cu.o
[138/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq4_xs.cu.o
[139/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-mxfp4.cu.o
[140/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-nvfp4.cu.o
[141/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q1_0.cu.o
[142/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q2_0.cu.o
[143/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q2_k.cu.o
[144/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q3_k.cu.o
[145/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/caps.cpp.o
[146/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q4_0.cu.o
[147/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q4_1.cu.o
[148/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q4_k.cu.o
[149/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q5_0.cu.o
[150/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q5_1.cu.o
[151/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q5_k.cu.o
[152/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q8_0.cu.o
[153/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q6_k.cu.o
[154/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_1.cu.o
[155/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_10.cu.o
[156/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_11.cu.o
[157/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_12.cu.o
[158/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_13.cu.o
[159/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_14.cu.o
[160/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_15.cu.o
[161/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_16.cu.o
[162/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_2.cu.o
[163/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_3.cu.o
[164/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_4.cu.o
[165/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_5.cu.o
[166/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_6.cu.o
[167/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_7.cu.o
[168/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_8.cu.o
[169/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_9.cu.o
[170/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-vec-instance-f16-f16.cu.o
[171/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-vec-instance-q4_0-q4_0.cu.o
[172/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-vec-instance-q8_0-q8_0.cu.o
[173/451] Building CXX object src/CMakeFiles/llama.dir/llama.cpp.o
[174/451] Building CXX object src/CMakeFiles/llama.dir/llama-adapter.cpp.o
[175/451] Building CXX object src/CMakeFiles/llama.dir/llama-arch.cpp.o
[176/451] Building CXX object src/CMakeFiles/llama.dir/llama-batch.cpp.o
[177/451] Building CXX object src/CMakeFiles/llama.dir/llama-chat.cpp.o
[178/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-vec-instance-bf16-bf16.cu.o
[179/451] Linking CUDA shared library bin/libggml-cuda.so.0.13.1
[180/451] Creating library symlink bin/libggml-cuda.so.0 bin/libggml-cuda.so
[181/451] Linking CXX shared library bin/libggml.so.0.13.1
[182/451] Creating library symlink bin/libggml.so.0 bin/libggml.so
[183/451] Building CXX object src/CMakeFiles/llama.dir/llama-cparams.cpp.o
[184/451] Building CXX object src/CMakeFiles/llama.dir/llama-context.cpp.o
[185/451] Building CXX object src/CMakeFiles/llama.dir/llama-graph.cpp.o
[186/451] Building CXX object src/CMakeFiles/llama.dir/llama-hparams.cpp.o
[187/451] Building CXX object src/CMakeFiles/llama.dir/llama-impl.cpp.o
[188/451] Building CXX object src/CMakeFiles/llama.dir/llama-io.cpp.o
[189/451] Building CXX object src/CMakeFiles/llama.dir/llama-grammar.cpp.o
[190/451] Building CXX object src/CMakeFiles/llama.dir/llama-kv-cache-iswa.cpp.o
[191/451] Building CXX object src/CMakeFiles/llama.dir/llama-kv-cache-dsa.cpp.o
[192/451] Building CXX object src/CMakeFiles/llama.dir/llama-memory-hybrid-iswa.cpp.o
[193/451] Building CXX object src/CMakeFiles/llama.dir/llama-kv-cache.cpp.o
[194/451] Building CXX object src/CMakeFiles/llama.dir/llama-mmap.cpp.o
[195/451] Building CXX object src/CMakeFiles/llama.dir/llama-memory-recurrent.cpp.o
[196/451] Building CXX object src/CMakeFiles/llama.dir/llama-model-saver.cpp.o
[197/451] Building CXX object src/CMakeFiles/llama.dir/llama-model-loader.cpp.o
[198/451] Building CXX object src/CMakeFiles/llama.dir/llama-model.cpp.o
[199/451] Building CXX object src/CMakeFiles/llama.dir/llama-quant.cpp.o
[200/451] Building CXX object src/CMakeFiles/llama.dir/llama-sampler.cpp.o
[201/451] Building CXX object src/CMakeFiles/llama.dir/unicode-data.cpp.o
[202/451] Building CXX object src/CMakeFiles/llama.dir/llama-vocab.cpp.o
[203/451] Building CXX object src/CMakeFiles/llama.dir/models/afmoe.cpp.o
[204/451] Building CXX object src/CMakeFiles/llama.dir/models/apertus.cpp.o
[205/451] Building CXX object src/CMakeFiles/llama.dir/models/arcee.cpp.o
[206/451] Building CXX object src/CMakeFiles/llama.dir/models/arctic.cpp.o
[207/451] Building CXX object src/CMakeFiles/llama.dir/models/arwkv7.cpp.o
[208/451] Building CXX object src/CMakeFiles/llama.dir/models/baichuan.cpp.o
[209/451] Building CXX object src/CMakeFiles/llama.dir/unicode.cpp.o
[210/451] Building CXX object src/CMakeFiles/llama.dir/models/bailingmoe.cpp.o
[211/451] Building CXX object src/CMakeFiles/llama.dir/models/bailingmoe2.cpp.o
[212/451] Building CXX object src/CMakeFiles/llama.dir/models/bert.cpp.o
[213/451] Building CXX object src/CMakeFiles/llama.dir/models/bitnet.cpp.o
[214/451] Building CXX object src/CMakeFiles/llama.dir/models/bloom.cpp.o
[215/451] Building CXX object src/CMakeFiles/llama.dir/models/chameleon.cpp.o
[216/451] Building CXX object src/CMakeFiles/llama.dir/models/chatglm.cpp.o
[217/451] Building CXX object src/CMakeFiles/llama.dir/models/codeshell.cpp.o
[218/451] Building CXX object src/CMakeFiles/llama.dir/models/cogvlm.cpp.o
[219/451] Building CXX object src/CMakeFiles/llama.dir/models/cohere2.cpp.o
[220/451] Building CXX object src/CMakeFiles/llama.dir/models/command-r.cpp.o
[221/451] Building CXX object src/CMakeFiles/llama.dir/models/dbrx.cpp.o
[222/451] Building CXX object src/CMakeFiles/llama.dir/models/deci.cpp.o
[223/451] Building CXX object src/CMakeFiles/llama.dir/models/deepseek.cpp.o
[224/451] Building CXX object src/CMakeFiles/llama.dir/models/deepseek2.cpp.o
[225/451] Building CXX object src/CMakeFiles/llama.dir/models/deepseek2ocr.cpp.o
[226/451] Building CXX object src/CMakeFiles/llama.dir/models/deepseek32.cpp.o
[227/451] Building CXX object src/CMakeFiles/llama.dir/models/delta-net-base.cpp.o
[228/451] Building CXX object src/CMakeFiles/llama.dir/models/dots1.cpp.o
[229/451] Building CXX object src/CMakeFiles/llama.dir/models/dream.cpp.o
[230/451] Building CXX object src/CMakeFiles/llama.dir/models/dspark.cpp.o
[231/451] Building CXX object src/CMakeFiles/llama.dir/models/ernie4-5-moe.cpp.o
[232/451] Building CXX object src/CMakeFiles/llama.dir/models/ernie4-5.cpp.o
[233/451] Building CXX object src/CMakeFiles/llama.dir/models/eurobert.cpp.o
[234/451] Building CXX object src/CMakeFiles/llama.dir/models/exaone-moe.cpp.o
[235/451] Building CXX object src/CMakeFiles/llama.dir/models/exaone.cpp.o
[236/451] Building CXX object src/CMakeFiles/llama.dir/models/exaone4.cpp.o
[237/451] Building CXX object src/CMakeFiles/llama.dir/models/falcon-h1.cpp.o
[238/451] Building CXX object src/CMakeFiles/llama.dir/models/falcon.cpp.o
[239/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma-embedding.cpp.o
[240/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma.cpp.o
[241/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma2.cpp.o
[242/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma3.cpp.o
[243/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma3n.cpp.o
[244/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma4-assistant.cpp.o
[245/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma4.cpp.o
[246/451] Building CXX object src/CMakeFiles/llama.dir/models/glm-dsa.cpp.o
[247/451] Building CXX object src/CMakeFiles/llama.dir/models/glm4-moe.cpp.o
[248/451] Building CXX object src/CMakeFiles/llama.dir/models/glm4.cpp.o
[249/451] Building CXX object src/CMakeFiles/llama.dir/models/gpt2.cpp.o
[250/451] Building CXX object src/CMakeFiles/llama.dir/models/gptneox.cpp.o
[251/451] Building CXX object src/CMakeFiles/llama.dir/models/granite-hybrid.cpp.o
[252/451] Building CXX object src/CMakeFiles/llama.dir/models/granite-moe.cpp.o
[253/451] Building CXX object src/CMakeFiles/llama.dir/models/granite.cpp.o
[254/451] Building CXX object src/CMakeFiles/llama.dir/models/grok.cpp.o
[255/451] Building CXX object src/CMakeFiles/llama.dir/models/grovemoe.cpp.o
[256/451] Building CXX object src/CMakeFiles/llama.dir/models/hunyuan-dense.cpp.o
[257/451] Building CXX object src/CMakeFiles/llama.dir/models/hunyuan-moe.cpp.o
[258/451] Building CXX object src/CMakeFiles/llama.dir/models/hunyuan-vl.cpp.o
[259/451] Building CXX object src/CMakeFiles/llama.dir/models/internlm2.cpp.o
[260/451] Building CXX object src/CMakeFiles/llama.dir/models/jais.cpp.o
[261/451] Building CXX object src/CMakeFiles/llama.dir/models/jais2.cpp.o
[262/451] Building CXX object src/CMakeFiles/llama.dir/models/jamba.cpp.o
[263/451] Building CXX object src/CMakeFiles/llama.dir/models/jina-bert-v2.cpp.o
[264/451] Building CXX object src/CMakeFiles/llama.dir/models/jina-bert-v3.cpp.o
[265/451] Building CXX object src/CMakeFiles/llama.dir/models/kimi-linear.cpp.o
[266/451] Building CXX object src/CMakeFiles/llama.dir/models/lfm2.cpp.o
[267/451] Building CXX object src/CMakeFiles/llama.dir/models/lfm2moe.cpp.o
[268/451] Building CXX object src/CMakeFiles/llama.dir/models/llada-moe.cpp.o
[269/451] Building CXX object src/CMakeFiles/llama.dir/models/llada.cpp.o
[270/451] Building CXX object src/CMakeFiles/llama.dir/models/llama-embed.cpp.o
[271/451] Building CXX object src/CMakeFiles/llama.dir/models/llama.cpp.o
[272/451] Building CXX object src/CMakeFiles/llama.dir/models/llama4.cpp.o
[273/451] Building CXX object src/CMakeFiles/llama.dir/models/maincoder.cpp.o
[274/451] Building CXX object src/CMakeFiles/llama.dir/models/mamba-base.cpp.o
[275/451] Building CXX object src/CMakeFiles/llama.dir/models/mamba.cpp.o
[276/451] Building CXX object src/CMakeFiles/llama.dir/models/mamba2.cpp.o
[277/451] Building CXX object src/CMakeFiles/llama.dir/models/mellum.cpp.o
[278/451] Building CXX object src/CMakeFiles/llama.dir/models/mimo2.cpp.o
[279/451] Building CXX object src/CMakeFiles/llama.dir/models/minicpm.cpp.o
[280/451] Building CXX object src/CMakeFiles/llama.dir/models/minicpm3.cpp.o
[281/451] Building CXX object src/CMakeFiles/llama.dir/models/minimax-m2.cpp.o
[282/451] Building CXX object src/CMakeFiles/llama.dir/models/mistral3.cpp.o
[283/451] Building CXX object src/CMakeFiles/llama.dir/models/mistral4.cpp.o
[284/451] Building CXX object src/CMakeFiles/llama.dir/models/modern-bert.cpp.o
[285/451] Building CXX object src/CMakeFiles/llama.dir/models/mpt.cpp.o
[286/451] Building CXX object src/CMakeFiles/llama.dir/models/nemotron-h-moe.cpp.o
[287/451] Building CXX object src/CMakeFiles/llama.dir/models/nemotron-h.cpp.o
[288/451] Building CXX object src/CMakeFiles/llama.dir/models/nemotron.cpp.o
[289/451] Building CXX object src/CMakeFiles/llama.dir/models/neo-bert.cpp.o
[290/451] Building CXX object src/CMakeFiles/llama.dir/models/nomic-bert-moe.cpp.o
[291/451] Building CXX object src/CMakeFiles/llama.dir/models/nomic-bert.cpp.o
[292/451] Building CXX object src/CMakeFiles/llama.dir/models/olmo.cpp.o
[293/451] Building CXX object src/CMakeFiles/llama.dir/models/olmo2.cpp.o
[294/451] Building CXX object src/CMakeFiles/llama.dir/models/olmoe.cpp.o
[295/451] Building CXX object src/CMakeFiles/llama.dir/models/openai-moe.cpp.o
[296/451] Building CXX object src/CMakeFiles/llama.dir/models/openelm.cpp.o
[297/451] Building CXX object src/CMakeFiles/llama.dir/models/paddleocr.cpp.o
[298/451] Building CXX object src/CMakeFiles/llama.dir/models/orion.cpp.o
[299/451] Building CXX object src/CMakeFiles/llama.dir/models/pangu-embed.cpp.o
[300/451] Building CXX object src/CMakeFiles/llama.dir/models/phi2.cpp.o
[301/451] Building CXX object src/CMakeFiles/llama.dir/models/phimoe.cpp.o
[302/451] Building CXX object src/CMakeFiles/llama.dir/models/phi3.cpp.o
[303/451] Building CXX object src/CMakeFiles/llama.dir/models/plamo.cpp.o
[304/451] Building CXX object src/CMakeFiles/llama.dir/models/plamo2.cpp.o
[305/451] Building CXX object src/CMakeFiles/llama.dir/models/plamo3.cpp.o
[306/451] Building CXX object src/CMakeFiles/llama.dir/models/plm.cpp.o
[307/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen.cpp.o
[308/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen2.cpp.o
[309/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen2moe.cpp.o
[310/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen2vl.cpp.o
[311/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3.cpp.o
[312/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen35.cpp.o
[313/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen35moe.cpp.o
[314/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3moe.cpp.o
[315/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3next.cpp.o
[316/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3vl.cpp.o
[317/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3vlmoe.cpp.o
[318/451] Building CXX object src/CMakeFiles/llama.dir/models/refact.cpp.o
[319/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv6-base.cpp.o
[320/451] Building CXX object src/CMakeFiles/llama.dir/models/rnd1.cpp.o
[321/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv6qwen2.cpp.o
[322/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv6.cpp.o
[323/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv7-base.cpp.o
[324/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv7.cpp.o
[325/451] Building CXX object src/CMakeFiles/llama.dir/models/seed-oss.cpp.o
[326/451] Building CXX object src/CMakeFiles/llama.dir/models/smallthinker.cpp.o
[327/451] Building CXX object src/CMakeFiles/llama.dir/models/smollm3.cpp.o
[328/451] Building CXX object src/CMakeFiles/llama.dir/models/stablelm.cpp.o
[329/451] Building CXX object src/CMakeFiles/llama.dir/models/starcoder.cpp.o
[330/451] Building CXX object src/CMakeFiles/llama.dir/models/starcoder2.cpp.o
[331/451] Building CXX object src/CMakeFiles/llama.dir/models/step35.cpp.o
[332/451] Building CXX object src/CMakeFiles/llama.dir/models/t5.cpp.o
[333/451] Building CXX object src/CMakeFiles/llama.dir/models/t5encoder.cpp.o
[334/451] Building CXX object src/CMakeFiles/llama.dir/models/talkie.cpp.o
[335/451] Building CXX object src/CMakeFiles/llama.dir/models/wavtokenizer-dec.cpp.o
[336/451] Building CXX object src/CMakeFiles/llama.dir/models/xverse.cpp.o
[337/451] Building CXX object common/CMakeFiles/llama-common-base.dir/build-info.cpp.o
[338/451] Linking CXX static library common/libllama-common-base.a
[339/451] Linking CXX shared library bin/libllama.so.0.0.1
[340/451] Creating library symlink bin/libllama.so.0 bin/libllama.so
[341/451] Building CXX object common/CMakeFiles/llama-common.dir/chat-auto-parser-generator.cpp.o
[342/451] Building CXX object common/CMakeFiles/llama-common.dir/chat-auto-parser-helpers.cpp.o
[343/451] Building CXX object common/CMakeFiles/llama-common.dir/arg.cpp.o
[344/451] Building CXX object common/CMakeFiles/llama-common.dir/chat-diff-analyzer.cpp.o
[345/451] Building CXX object common/CMakeFiles/llama-common.dir/chat-peg-parser.cpp.o
[346/451] Building CXX object common/CMakeFiles/llama-common.dir/common.cpp.o
[347/451] Building CXX object common/CMakeFiles/llama-common.dir/console.cpp.o
[348/451] Building CXX object common/CMakeFiles/llama-common.dir/chat.cpp.o
[349/451] Building CXX object common/CMakeFiles/llama-common.dir/debug.cpp.o
[350/451] Building CXX object common/CMakeFiles/llama-common.dir/fit.cpp.o
[351/451] Building CXX object common/CMakeFiles/llama-common.dir/download.cpp.o
[352/451] Building CXX object common/CMakeFiles/llama-common.dir/imatrix-loader.cpp.o
[353/451] Building CXX object common/CMakeFiles/llama-common.dir/hf-cache.cpp.o
[354/451] Building CXX object common/CMakeFiles/llama-common.dir/json-partial.cpp.o
[355/451] Building CXX object common/CMakeFiles/llama-common.dir/kv-mean-center.cpp.o
[356/451] Building CXX object common/CMakeFiles/llama-common.dir/llguidance.cpp.o
[357/451] Building CXX object common/CMakeFiles/llama-common.dir/log.cpp.o
[358/451] Building CXX object common/CMakeFiles/llama-common.dir/json-schema-to-grammar.cpp.o
[359/451] Building CXX object common/CMakeFiles/llama-common.dir/ngram-cache.cpp.o
[360/451] Building CXX object common/CMakeFiles/llama-common.dir/ngram-map.cpp.o
[361/451] Building CXX object common/CMakeFiles/llama-common.dir/ngram-mod.cpp.o
[362/451] Building CXX object common/CMakeFiles/llama-common.dir/preset.cpp.o
[363/451] Building CXX object common/CMakeFiles/llama-common.dir/regex-partial.cpp.o
[364/451] Building CXX object common/CMakeFiles/llama-common.dir/reasoning-budget.cpp.o
[365/451] Building CXX object common/CMakeFiles/llama-common.dir/sampling.cpp.o
[366/451] Building CXX object common/CMakeFiles/llama-common.dir/speculative.cpp.o
[367/451] Building CXX object common/CMakeFiles/llama-common.dir/peg-parser.cpp.o
[368/451] Building CXX object common/CMakeFiles/llama-common.dir/unicode.cpp.o
[369/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/lexer.cpp.o
[370/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/parser.cpp.o
[371/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/runtime.cpp.o
[372/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/string.cpp.o
[373/451] Building CUDA object common/CMakeFiles/llama-common.dir/dspark-markov.cu.o
[374/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/value.cpp.o
[375/451] Building CXX object vendor/cpp-httplib/CMakeFiles/cpp-httplib.dir/httplib.cpp.o
[376/451] Linking CXX static library vendor/cpp-httplib/libcpp-httplib.a
[377/451] Linking CXX shared library bin/libllama-common.so.0.0.1
[378/451] Creating library symlink bin/libllama-common.so.0 bin/libllama-common.so
[379/451] Building CXX object tests/CMakeFiles/test-backend-ops.dir/get-model.cpp.o
[380/451] Building CXX object examples/training/CMakeFiles/llama-finetune.dir/finetune.cpp.o
[381/451] Linking CXX executable bin/llama-finetune
[382/451] Building CXX object tests/CMakeFiles/test-backend-ops.dir/test-backend-ops.cpp.o
[383/451] Linking CXX executable bin/test-backend-ops
[384/451] Building CXX object tools/completion/CMakeFiles/llama-completion.dir/main.cpp.o
[385/451] Building CXX object tools/ui/CMakeFiles/llama-ui-embed.dir/embed.cpp.o
[386/451] Linking CXX executable tools/ui/llama-ui-embed
[387/451] Building CXX object tools/completion/CMakeFiles/llama-completion-impl.dir/completion.cpp.o
[388/451] Linking CXX shared library bin/libllama-completion-impl.so
[389/451] Linking CXX executable bin/llama-completion
[390/451] Provisioning UI assets
-- UI: downloading from b1: https://huggingface.co/buckets/ggml-org/llama-ui/resolve/b1
-- UI: download bundle.css from b1 failed: "HTTP response code said error"
-- UI: downloading from latest: https://huggingface.co/buckets/ggml-org/llama-ui/resolve/latest
-- UI: download bundle.css from latest failed: "HTTP response code said error"
-- UI: HF download failed
CMake Warning at /content/Prism-llama.cpp/scripts/ui-assets.cmake:348 (message):
UI: no assets available - building without an embedded UI. In a
disconnected environment, download the pre-built UI from a llama.cpp
release at https://github.com/ggml-org/llama.cpp/releases and extract to
tools/ui/dist.
[391/451] Building CXX object tools/ui/CMakeFiles/llama-ui.dir/ui.cpp.o
[392/451] Linking CXX static library tools/ui/libllama-ui.a
[393/451] Building CXX object tools/cli/CMakeFiles/llama-cli.dir/main.cpp.o
[394/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-chat.cpp.o
[395/451] Building CXX object tools/cli/CMakeFiles/llama-cli-impl.dir/cli.cpp.o
[396/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-queue.cpp.o
[397/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-task.cpp.o
[398/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-common.cpp.o
[399/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-tools.cpp.o
[400/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-context.cpp.o
[401/451] Building CXX object tools/server/CMakeFiles/llama-server-impl.dir/server.cpp.o
[402/451] Building CXX object tools/server/CMakeFiles/llama-server-impl.dir/server-http.cpp.o
[403/451] Building CXX object tools/server/CMakeFiles/llama-server.dir/main.cpp.o
[404/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/mtmd.cpp.o
[405/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/mtmd-audio.cpp.o
[406/451] Building CXX object tools/server/CMakeFiles/llama-server-impl.dir/server-models.cpp.o
[407/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/mtmd-image.cpp.o
[408/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/clip.cpp.o
[409/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/cogvlm.cpp.o
[410/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/mtmd-helper.cpp.o
[411/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/conformer.cpp.o
[412/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/dotsocr.cpp.o
[413/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/exaone4_5.cpp.o
[414/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/gemma4a.cpp.o
[415/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/gemma4v.cpp.o
[416/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/gemma4ua.cpp.o
[417/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/gemma4uv.cpp.o
[418/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/glm4v.cpp.o
[419/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/granite-speech.cpp.o
[420/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/granite4-vision.cpp.o
[421/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/hunyuanvl.cpp.o
[422/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/internvl.cpp.o
[423/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/kimivl.cpp.o
[424/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/kimik25.cpp.o
[425/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/nemotron-v2-vl.cpp.o
[426/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/llama4.cpp.o
[427/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/llava.cpp.o
[428/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/minicpmv.cpp.o
[429/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/paddleocr.cpp.o
[430/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/pixtral.cpp.o
[431/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/qwen2vl.cpp.o
[432/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/qwen3vl.cpp.o
[433/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/mimovl.cpp.o
[434/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/qwen3a.cpp.o
[435/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/step3vl.cpp.o
[436/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/siglip.cpp.o
[437/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/whisper-enc.cpp.o
[438/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/deepseekocr.cpp.o
[439/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/deepseekocr2.cpp.o
[440/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/mobilenetv5.cpp.o
[441/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/youtuvl.cpp.o
[442/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/yasa2.cpp.o
[443/451] Linking CXX shared library bin/libmtmd.so.0.0.1
[444/451] Creating library symlink bin/libmtmd.so.0 bin/libmtmd.so
[445/451] Linking CXX static library tools/server/libserver-context.a
[446/451] Linking CXX shared library bin/libllama-cli-impl.so
[447/451] Linking CXX executable bin/llama-cli
[448/451] Linking CXX shared library bin/libllama-server-impl.so
[449/451] Linking CXX executable bin/llama-server
[450/451] Building CXX object tools/export-lora/CMakeFiles/llama-export-lora.dir/export-lora.cpp.o
[451/451] Linking CXX executable bin/llama-export-lora
RETURN CODE: 0
================================================================================================================
BUILT BINARIES
================================================================================================================
[PASS] llama-cli: /content/Prism-llama.cpp/build/bin/llama-cli
size=17,888 bytes
sha256=bdbd81034512fdc6ae4a674a67ed50adb87c46b134b708609978880b0fc8a24c
[PASS] llama-completion: /content/Prism-llama.cpp/build/bin/llama-completion
size=15,968 bytes
sha256=698bdd659e5d1332ecc9da02448d60cfa650f8cbc754df5aa90f8da5c3d218b3
[PASS] llama-server: /content/Prism-llama.cpp/build/bin/llama-server
size=17,896 bytes
sha256=903526b58a5cc21e208382f3f6d3d6ee272c9307908955fd2088aaa26d5fb3ab
[PASS] llama-finetune: /content/Prism-llama.cpp/build/bin/llama-finetune
size=40,648 bytes
sha256=f33b406af0091902ebe1ee183165b9f1f9cdb69206b96e08eda764a274cf158a
[PASS] llama-export-lora: /content/Prism-llama.cpp/build/bin/llama-export-lora
size=89,592 bytes
sha256=ec09b5231dc60859c4955d2bd88c3f84dd1b8421a4d8444ae5ab1b83130559ad
[PASS] test-backend-ops: /content/Prism-llama.cpp/build/bin/test-backend-ops
size=1,157,008 bytes
sha256=dc031c693d34dba11ae49a680e98d1ed66b1075daf4a14fb8d68a05408bb4506
================================================================================================================
BINARY SMOKE TESTS
================================================================================================================
llama-cli: return_code=0
----- common params -----
-h, --help, --usage print usage and exit
--version show version and build info
-cl, --cache-list show list of models in cache
--completion-bash print source-able bash completion script for llama.cpp
-t, --threads N number of CPU threads to use during generation (default: -1)
(env: LLAMA_ARG_THREADS)
-tb, --threads-batch N number of threads to use during batch and prompt processing (default:
same as --threads)
-C, --cpu-mask M CPU affinity mask: arbitrarily long hex. Complements cpu-range
(default: "")
-Cr, --cpu-range lo-hi range of CPUs for affinity. Complements --cpu-mask
--cpu-strict <0|1> use strict CPU placement (default: 0)
--prio N set process/thread priority : low(-1), normal(0), medium(1), high(2),
realtime(3) (default: 0)
--poll <0...100> use polling level to wait for work (0 - no polling, default: 50)
-Cb, --cpu-mask-batch M CPU affinity mask: arbitrarily long hex. Complements cpu-range-batch
(default: same as --cpu-mask)
-Crb, --cpu-range-batch lo-hi ranges of CPUs for affinity. Complements --cpu-mask-batch
--cpu-strict-batch <0|1> use strict CPU placement (default: same as --cpu-strict)
--prio-batch N set process/thread priority : 0-normal, 1-medium, 2-high, 3-realtime
(default: 0)
--poll-batch <0|1> use polling to wait for work (default: same as --poll)
-c, --ctx-size N size of the prompt context (default: 0, 0 = loaded from model)
(env: LLAMA_ARG_CTX_SIZE)
-n, --predict, --n-predict N number of tokens to predict (default: -1, -1 = infinity)
(env: LLAMA_ARG_N_PREDICT)
-b, --batch-size N logical maximum batch size (default: 2048)
(env: LLAMA_ARG_BATCH)
llama-completion: return_code=0
----- common params -----
-h, --help, --usage print usage and exit
--version show version and build info
-cl, --cache-list show list of models in cache
--completion-bash print source-able bash completion script for llama.cpp
-t, --threads N number of CPU threads to use during generation (default: -1)
(env: LLAMA_ARG_THREADS)
-tb, --threads-batch N number of threads to use during batch and prompt processing (default:
same as --threads)
-C, --cpu-mask M CPU affinity mask: arbitrarily long hex. Complements cpu-range
(default: "")
-Cr, --cpu-range lo-hi range of CPUs for affinity. Complements --cpu-mask
--cpu-strict <0|1> use strict CPU placement (default: 0)
--prio N set process/thread priority : low(-1), normal(0), medium(1), high(2),
realtime(3) (default: 0)
--poll <0...100> use polling level to wait for work (0 - no polling, default: 50)
-Cb, --cpu-mask-batch M CPU affinity mask: arbitrarily long hex. Complements cpu-range-batch
(default: same as --cpu-mask)
-Crb, --cpu-range-batch lo-hi ranges of CPUs for affinity. Complements --cpu-mask-batch
--cpu-strict-batch <0|1> use strict CPU placement (default: same as --cpu-strict)
--prio-batch N set process/thread priority : 0-normal, 1-medium, 2-high, 3-realtime
(default: 0)
--poll-batch <0|1> use polling to wait for work (default: same as --poll)
-c, --ctx-size N size of the prompt context (default: 0, 0 = loaded from model)
(env: LLAMA_ARG_CTX_SIZE)
-n, --predict, --n-predict N number of tokens to predict (default: -1, -1 = infinity, -2 = until
context filled)
(env: LLAMA_ARG_N_PREDICT)
-b, --batch-size N logical maximum batch size (default: 2048)
llama-finetune: return_code=0
----- common params -----
-h, --help, --usage print usage and exit
--version show version and build info
-cl, --cache-list show list of models in cache
--completion-bash print source-able bash completion script for llama.cpp
-t, --threads N number of CPU threads to use during generation (default: -1)
(env: LLAMA_ARG_THREADS)
-tb, --threads-batch N number of threads to use during batch and prompt processing (default:
same as --threads)
-C, --cpu-mask M CPU affinity mask: arbitrarily long hex. Complements cpu-range
(default: "")
-Cr, --cpu-range lo-hi range of CPUs for affinity. Complements --cpu-mask
--cpu-strict <0|1> use strict CPU placement (default: 0)
--prio N set process/thread priority : low(-1), normal(0), medium(1), high(2),
realtime(3) (default: 0)
--poll <0...100> use polling level to wait for work (0 - no polling, default: 50)
-Cb, --cpu-mask-batch M CPU affinity mask: arbitrarily long hex. Complements cpu-range-batch
(default: same as --cpu-mask)
-Crb, --cpu-range-batch lo-hi ranges of CPUs for affinity. Complements --cpu-mask-batch
--cpu-strict-batch <0|1> use strict CPU placement (default: same as --cpu-strict)
--prio-batch N set process/thread priority : 0-normal, 1-medium, 2-high, 3-realtime
(default: 0)
--poll-batch <0|1> use polling to wait for work (default: same as --poll)
-c, --ctx-size N size of the prompt context (default: 0, 0 = loaded from model)
(env: LLAMA_ARG_CTX_SIZE)
-n, --predict, --n-predict N number of tokens to predict (default: -1, -1 = infinity)
(env: LLAMA_ARG_N_PREDICT)
-b, --batch-size N logical maximum batch size (default: 2048)
(env: LLAMA_ARG_BATCH)
llama-export-lora: return_code=0
----- common params -----
-h, --help, --usage print usage and exit
--version show version and build info
-cl, --cache-list show list of models in cache
--completion-bash print source-able bash completion script for llama.cpp
-t, --threads N number of CPU threads to use during generation (default: -1)
(env: LLAMA_ARG_THREADS)
-tb, --threads-batch N number of threads to use during batch and prompt processing (default:
same as --threads)
-C, --cpu-mask M CPU affinity mask: arbitrarily long hex. Complements cpu-range
(default: "")
-Cr, --cpu-range lo-hi range of CPUs for affinity. Complements --cpu-mask
--cpu-strict <0|1> use strict CPU placement (default: 0)
--prio N set process/thread priority : low(-1), normal(0), medium(1), high(2),
realtime(3) (default: 0)
--poll <0...100> use polling level to wait for work (0 - no polling, default: 50)
-Cb, --cpu-mask-batch M CPU affinity mask: arbitrarily long hex. Complements cpu-range-batch
(default: same as --cpu-mask)
-Crb, --cpu-range-batch lo-hi ranges of CPUs for affinity. Complements --cpu-mask-batch
--cpu-strict-batch <0|1> use strict CPU placement (default: same as --cpu-strict)
--prio-batch N set process/thread priority : 0-normal, 1-medium, 2-high, 3-realtime
(default: 0)
--poll-batch <0|1> use polling to wait for work (default: same as --poll)
-c, --ctx-size N size of the prompt context (default: 0, 0 = loaded from model)
(env: LLAMA_ARG_CTX_SIZE)
-n, --predict, --n-predict N number of tokens to predict (default: -1, -1 = infinity)
(env: LLAMA_ARG_N_PREDICT)
-b, --batch-size N logical maximum batch size (default: 2048)
(env: LLAMA_ARG_BATCH)
test-backend-ops: return_code=1
Usage: /content/Prism-llama.cpp/build/bin/test-backend-ops [mode] [-o <op,..>] [-b <backend>] [-p <params regex>] [--output <console|sql|csv>] [--list-ops] [--show-coverage] [--test-file <path>] [-j <n>]
valid modes:
- test (default, compare with CPU backend for correctness)
- grad (compare gradients from backpropagation with method of finite differences)
- perf (performance evaluation)
- support (probe backend operation support)
op names for -o are as given by ggml_op_desc() (e.g. ADD, MUL_MAT, etc),
optionally including the full test case string (e.g. "ADD(type=f16,ne=[1,1,8,1],nr=[1,1,1,1],nf=1)")
--output specifies output format (default: console, options: console, sql, csv)
--list-ops lists all available GGML operations
--show-coverage shows test coverage
--test-file reads test operators from a test file generated by llama-export-graph-ops
-j <n> runs tests using <n> parallel worker threads (default: 1, test mode only)
================================================================================================================
SOURCE HASH BASELINE
================================================================================================================
8fe7c384f84fcb9c0b396f2aba9122c0a9f0172260f7a7bd4bedfdd2c627f171 ggml/src/ggml-cuda/mmq.cu
ab36e05057c754f016ef229f478d9c871e2bb1502c1059bc21e7f777b80bb83a ggml/src/ggml-cuda/mmq.cuh
637928070f54fd92749b83bd1ebce2bf101ad9fe3989afe52ab48dcefc9855b4 ggml/src/ggml-cuda/out-prod.cu
e91732f059f13cbb4ef62ed4435738db5d22e24d77bad7f727d5b7919beadfcf ggml/src/ggml-cuda/ggml-cuda.cu
24a0615d0feb09b6041528215bef01cc0c2aba35b8cd49f8164ace49abb1a997 ggml/src/ggml.c
d1f710b1ea3aa0f7da5f698a8a6a7e3b19adfc87c329ebc0b70ee0ac667efa4c tests/test-backend-ops.cpp
276e5410995dab8ca4cbb8448270c59836488e22be916e2004cc4fb1129ebd17 examples/training/finetune.cpp
f593edae28d12e4ed59c7211e74779680b9af28f34f590103f446d659874681b src/llama-adapter.cpp
================================================================================================================
CMAKE CACHE SUMMARY
================================================================================================================
BUILD_TESTING:BOOL=ON
CMAKE_BUILD_TYPE:STRING=Release
CMAKE_CUDA_ARCHITECTURES:UNINITIALIZED=89
GGML_CCACHE:BOOL=ON
GGML_CCACHE_FOUND:FILEPATH=/usr/bin/ccache
GGML_CUDA:BOOL=ON
GGML_CUDA_COMPRESSION_MODE:STRING=size
GGML_CUDA_CUTLASS_DIR:PATH=
GGML_CUDA_FA:BOOL=ON
GGML_CUDA_FA_ALL_QUANTS:BOOL=OFF
GGML_CUDA_FORCE_CUBLAS:BOOL=OFF
GGML_CUDA_FORCE_MMQ:BOOL=OFF
GGML_CUDA_GRAPHS:BOOL=ON
GGML_CUDA_HOPPER_Q1:BOOL=OFF
GGML_CUDA_NCCL:BOOL=ON
GGML_CUDA_NO_PEER_COPY:BOOL=OFF
GGML_CUDA_NO_VMM:BOOL=OFF
GGML_CUDA_PEER_MAX_BATCH_SIZE:STRING=128
LLAMA_BUILD_COMMON:BOOL=ON
LLAMA_BUILD_EXAMPLES:BOOL=ON
LLAMA_BUILD_SERVER:BOOL=ON
LLAMA_BUILD_TESTS:BOOL=ON
LLAMA_BUILD_TOOLS:BOOL=ON
GGML_CUDA_COMPRESSION_MODE-STRINGS:INTERNAL=none;speed;balance;size
================================================================================================================
CCACHE SUMMARY
================================================================================================================
Summary:
Hits: 0 / 422 (0.00 %)
Direct: 0 / 422 (0.00 %)
Preprocessed: 0 / 422 (0.00 %)
Misses: 422
Direct: 422
Preprocessed: 422
Primary storage:
Hits: 0 / 844 (0.00 %)
Misses: 844
Cache size (GB): 0.06 / 10.00 (0.63 %)
Use the -v/--verbose option for more details.
Return code: 0
================================================================================================================
FINAL GIT STATE
================================================================================================================
Working tree status: <clean>
Status command return code: 0
================================================================================================================
FINAL RESULT
================================================================================================================
[PASS] Fresh Colab dependencies installed.
[PASS] CUDA runtime and nvcc verified.
[PASS] Official Prism repository fetched.
[PASS] Exact Prism commit verified.
[PASS] Clean detached source checkout created.
[PASS] CUDA SM architecture configured.
[PASS] Examples, tools, server and tests enabled.
[PASS] llama-cli built.
[PASS] llama-completion built.
[PASS] llama-server built.
[PASS] llama-finetune built.
[PASS] llama-export-lora built.
[PASS] test-backend-ops built.
[PASS] Source hash baseline recorded.
[PASS] Project configuration written.
[PASS] Reusable path helper written.
Status: PASS
Elapsed: 33:26
No Prism source patches have been applied.
No model has been downloaded.
No training has been started.
The next implementation stage is the isolated exact training-forward primitive:
packed Q1 weight × F32 activation -> F32 output
with Q1 signs/scales decoded only inside the CUDA kernel.