================================================================================================================ NATIVE PACKED-Q1 LORA BOOTSTRAP ================================================================================================================ Started UTC: 2026-07-20T22:01:27Z Repository URL: https://github.com/PrismML-Eng/llama.cpp.git Required commit: 7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f Repository directory: /content/Prism-llama.cpp Build directory: /content/Prism-llama.cpp/build Project directory: /content/prism_native_q1_lora Model directory: /content/models/Bonsai-27B-Q1 Build jobs: 2 Python: 3.12.13 (main, Mar 4 2026, 09:23:07) [GCC 11.4.0] Platform: Linux-6.6.122+-x86_64-with-glibc2.35 ================================================================================================================ APT PACKAGE INDEX ================================================================================================================ COMMAND: 'apt-get' 'update' '-qq' W: Skipping acquire of configured file 'main/source/Sources' as repository 'https://r2u.stat.illinois.edu/ubuntu jammy InRelease' does not seem to provide it (sources.list entry misspelt?) RETURN CODE: 0 ================================================================================================================ INSTALL BUILD DEPENDENCIES ================================================================================================================ COMMAND: 'apt-get' 'install' '-y' '-qq' 'build-essential' 'cmake' 'ninja-build' 'ccache' 'git' 'git-lfs' 'pkg-config' 'libssl-dev' 'libcurl4-openssl-dev' 'python3-dev' Preconfiguring packages ... (Reading database ... (Reading database ... 5% (Reading database ... 10% (Reading database ... 15% (Reading database ... 20% (Reading database ... 25% (Reading database ... 30% (Reading database ... 35% (Reading database ... 40% (Reading database ... 45% (Reading database ... 50% (Reading database ... 55% (Reading database ... 60% (Reading database ... 65% (Reading database ... 70% (Reading database ... 75% (Reading database ... 80% (Reading database ... 85% (Reading database ... 90% (Reading database ... 95% (Reading database ... 100% (Reading database ... 122403 files and directories currently installed.) Removing r-base-dev (4.6.0-4.2204.0) ... dpkg: pkgconf: dependency problems, but removing anyway as you requested: libsndfile1-dev:amd64 depends on pkg-config; however: Package pkg-config is not installed. Package pkgconf which provides pkg-config is to be removed. libmkl-dev:amd64 depends on pkg-config; however: Package pkg-config is not installed. Package pkgconf which provides pkg-config is to be removed. libglib2.0-dev:amd64 depends on pkg-config; however: Package pkg-config is not installed. Package pkgconf which provides pkg-config is to be removed. libfontconfig-dev:amd64 depends on pkg-config; however: Package pkg-config is not installed. Package pkgconf which provides pkg-config is to be removed. Removing pkgconf (1.8.0-1) ... Removing 'diversion of /usr/bin/pkg-config to /usr/bin/pkg-config.real by pkgconf' Removing 'diversion of /usr/share/aclocal/pkg.m4 to /usr/share/aclocal/pkg.real.m4 by pkgconf' Removing 'diversion of /usr/share/man/man1/pkg-config.1.gz to /usr/share/man/man1/pkg-config.real.1.gz by pkgconf' Removing 'diversion of /usr/share/pkg-config-crosswrapper to /usr/share/pkg-config-crosswrapper.real by pkgconf' Selecting previously unselected package pkg-config. (Reading database ... (Reading database ... 5% (Reading database ... 10% (Reading database ... 15% (Reading database ... 20% (Reading database ... 25% (Reading database ... 30% (Reading database ... 35% (Reading database ... 40% (Reading database ... 45% (Reading database ... 50% (Reading database ... 55% (Reading database ... 60% (Reading database ... 65% (Reading database ... 70% (Reading database ... 75% (Reading database ... 80% (Reading database ... 85% (Reading database ... 90% (Reading database ... 95% (Reading database ... 100% (Reading database ... 122380 files and directories currently installed.) Preparing to unpack .../pkg-config_0.29.2-1ubuntu3_amd64.deb ... Unpacking pkg-config (0.29.2-1ubuntu3) ... Preparing to unpack .../libpython3.10-dev_3.10.12-1~22.04.16_amd64.deb ... Unpacking libpython3.10-dev:amd64 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ... Preparing to unpack .../libpython3.10_3.10.12-1~22.04.16_amd64.deb ... Unpacking libpython3.10:amd64 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ... Preparing to unpack .../libssl-dev_3.0.2-0ubuntu1.25_amd64.deb ... Unpacking libssl-dev:amd64 (3.0.2-0ubuntu1.25) over (3.0.2-0ubuntu1.23) ... Preparing to unpack .../libssl3_3.0.2-0ubuntu1.25_amd64.deb ... Unpacking libssl3:amd64 (3.0.2-0ubuntu1.25) over (3.0.2-0ubuntu1.23) ... Setting up libssl3:amd64 (3.0.2-0ubuntu1.25) ... (Reading database ... (Reading database ... 5% (Reading database ... 10% (Reading database ... 15% (Reading database ... 20% (Reading database ... 25% (Reading database ... 30% (Reading database ... 35% (Reading database ... 40% (Reading database ... 45% (Reading database ... 50% (Reading database ... 55% (Reading database ... 60% (Reading database ... 65% (Reading database ... 70% (Reading database ... 75% (Reading database ... 80% (Reading database ... 85% (Reading database ... 90% (Reading database ... 95% (Reading database ... 100% (Reading database ... 122395 files and directories currently installed.) Preparing to unpack .../00-python3.10_3.10.12-1~22.04.16_amd64.deb ... Unpacking python3.10 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ... Preparing to unpack .../01-libpython3.10-stdlib_3.10.12-1~22.04.16_amd64.deb ... Unpacking libpython3.10-stdlib:amd64 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ... Preparing to unpack .../02-python3.10-minimal_3.10.12-1~22.04.16_amd64.deb ... Unpacking python3.10-minimal (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ... Preparing to unpack .../03-libpython3.10-minimal_3.10.12-1~22.04.16_amd64.deb ... Unpacking libpython3.10-minimal:amd64 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ... Selecting previously unselected package libhiredis0.14:amd64. Preparing to unpack .../04-libhiredis0.14_0.14.1-2_amd64.deb ... Unpacking libhiredis0.14:amd64 (0.14.1-2) ... Selecting previously unselected package ccache. Preparing to unpack .../05-ccache_4.5.1-1_amd64.deb ... Unpacking ccache (4.5.1-1) ... Preparing to unpack .../06-libcurl4-openssl-dev_7.81.0-1ubuntu1.25_amd64.deb ... Unpacking libcurl4-openssl-dev:amd64 (7.81.0-1ubuntu1.25) over (7.81.0-1ubuntu1.24) ... Preparing to unpack .../07-curl_7.81.0-1ubuntu1.25_amd64.deb ... Unpacking curl (7.81.0-1ubuntu1.25) over (7.81.0-1ubuntu1.24) ... Preparing to unpack .../08-libcurl4_7.81.0-1ubuntu1.25_amd64.deb ... Unpacking libcurl4:amd64 (7.81.0-1ubuntu1.25) over (7.81.0-1ubuntu1.24) ... Selecting previously unselected package git-lfs. Preparing to unpack .../09-git-lfs_3.0.2-1ubuntu0.3_amd64.deb ... Unpacking git-lfs (3.0.2-1ubuntu0.3) ... Selecting previously unselected package javascript-common. Preparing to unpack .../10-javascript-common_11+nmu1_all.deb ... Unpacking javascript-common (11+nmu1) ... Selecting previously unselected package libjs-underscore. Preparing to unpack .../11-libjs-underscore_1.13.2~dfsg-2_all.deb ... Unpacking libjs-underscore (1.13.2~dfsg-2) ... Selecting previously unselected package libjs-sphinxdoc. Preparing to unpack .../12-libjs-sphinxdoc_4.3.2-1_all.deb ... Unpacking libjs-sphinxdoc (4.3.2-1) ... Selecting previously unselected package ninja-build. Preparing to unpack .../13-ninja-build_1.10.1-1_amd64.deb ... Unpacking ninja-build (1.10.1-1) ... Selecting previously unselected package python3.10-dev. Preparing to unpack .../14-python3.10-dev_3.10.12-1~22.04.16_amd64.deb ... Unpacking python3.10-dev (3.10.12-1~22.04.16) ... Selecting previously unselected package python3-dev. Preparing to unpack .../15-python3-dev_3.10.6-1~22.04.1_amd64.deb ... Unpacking python3-dev (3.10.6-1~22.04.1) ... Preparing to unpack .../16-r-base-core_4.6.1-1.2204.1_amd64.deb ... Unpacking r-base-core (4.6.1-1.2204.1) over (4.6.0-4.2204.0) ... Setting up javascript-common (11+nmu1) ... Setting up ninja-build (1.10.1-1) ... Setting up libssl-dev:amd64 (3.0.2-0ubuntu1.25) ... Setting up libpython3.10-minimal:amd64 (3.10.12-1~22.04.16) ... Setting up pkg-config (0.29.2-1ubuntu3) ... Setting up libcurl4:amd64 (7.81.0-1ubuntu1.25) ... Setting up curl (7.81.0-1ubuntu1.25) ... Setting up git-lfs (3.0.2-1ubuntu0.3) ... Setting up libjs-underscore (1.13.2~dfsg-2) ... Setting up libhiredis0.14:amd64 (0.14.1-2) ... Setting up ccache (4.5.1-1) ... Updating symlinks in /usr/lib/ccache ... Setting up python3.10-minimal (3.10.12-1~22.04.16) ... Setting up libpython3.10-stdlib:amd64 (3.10.12-1~22.04.16) ... Setting up libcurl4-openssl-dev:amd64 (7.81.0-1ubuntu1.25) ... Setting up r-base-core (4.6.1-1.2204.1) ... Installing new version of config file /etc/R/Makeconf ... Setting up libjs-sphinxdoc (4.3.2-1) ... Setting up libpython3.10:amd64 (3.10.12-1~22.04.16) ... Setting up python3.10 (3.10.12-1~22.04.16) ... Setting up libpython3.10-dev:amd64 (3.10.12-1~22.04.16) ... Setting up python3.10-dev (3.10.12-1~22.04.16) ... Setting up python3-dev (3.10.6-1~22.04.1) ... Processing triggers for hicolor-icon-theme (0.17-2) ... Processing triggers for libc-bin (2.35-0ubuntu3.8) ... /sbin/ldconfig.real: /usr/local/lib/libumf.so.1 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libtbbmalloc.so.2 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libur_adapter_level_zero_v2.so.0 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libtbbbind_2_5.so.3 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libur_adapter_level_zero.so.0 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libur_adapter_opencl.so.0 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libtbbmalloc_proxy.so.2 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libur_loader.so.0 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libtbbbind.so.3 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libtcm_debug.so.1 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libhwloc.so.15 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libtbb.so.12 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libtbbbind_2_0.so.3 is not a symbolic link /sbin/ldconfig.real: /usr/local/lib/libtcm.so.1 is not a symbolic link Processing triggers for man-db (2.10.2-1) ... Processing triggers for mailcap (3.70+nmu1ubuntu1) ... RETURN CODE: 0 ================================================================================================================ INSTALL PYTHON DOWNLOAD DEPENDENCIES ================================================================================================================ COMMAND: '/usr/bin/python3' '-m' 'pip' 'install' '-q' '--upgrade' 'huggingface_hub' 'hf_transfer' 'safetensors' ━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━ 771.9/771.9 kB 46.1 MB/s eta 0:00:00 ━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━ 3.6/3.6 MB 125.4 MB/s eta 0:00:00 RETURN CODE: 0 ================================================================================================================ CUDA ENVIRONMENT ================================================================================================================ PyTorch version: 2.11.0+cu128 PyTorch CUDA version: 12.8 CUDA device index: 0 CUDA device name: NVIDIA L4 CUDA compute capability: 8.9 CMake CUDA architecture: 89 Total VRAM: 22.034 GiB NVIDIA-SMI: Mon Jul 20 22:02:07 2026 +-----------------------------------------------------------------------------------------+ | NVIDIA-SMI 580.82.07 Driver Version: 580.82.07 CUDA Version: 13.0 | +-----------------------------------------+------------------------+----------------------+ | GPU Name Persistence-M | Bus-Id Disp.A | Volatile Uncorr. ECC | | Fan Temp Perf Pwr:Usage/Cap | Memory-Usage | GPU-Util Compute M. | | | | MIG M. | |=========================================+========================+======================| | 0 NVIDIA L4 Off | 00000000:00:03.0 Off | 0 | | N/A 36C P8 14W / 72W | 3MiB / 23034MiB | 0% Default | | | | N/A | +-----------------------------------------+------------------------+----------------------+ +-----------------------------------------------------------------------------------------+ | Processes: | | GPU GI CI PID Type Process name GPU Memory | | ID ID Usage | |=========================================================================================| | No running processes found | +-----------------------------------------------------------------------------------------+ NVIDIA-SMI return code: 0 NVCC: nvcc: NVIDIA (R) Cuda compiler driver Copyright (c) 2005-2025 NVIDIA Corporation Built on Fri_Feb_21_20:23:50_PST_2025 Cuda compilation tools, release 12.8, V12.8.93 Build cuda_12.8.r12.8/compiler.35583870_0 NVCC return code: 0 ================================================================================================================ CONFIGURE CCACHE ================================================================================================================ COMMAND: 'ccache' '--max-size' '10G' Set cache size limit to 10.0 GB RETURN CODE: 0 ================================================================================================================ INITIALIZE PRISM REPOSITORY ================================================================================================================ COMMAND: 'git' 'init' '/content/Prism-llama.cpp' hint: Using 'master' as the name for the initial branch. This default branch name hint: is subject to change. To configure the initial branch name to use in all hint: of your new repositories, which will suppress this warning, call: hint: hint: git config --global init.defaultBranch hint: hint: Names commonly chosen instead of 'master' are 'main', 'trunk' and hint: 'development'. The just-created branch can be renamed via this command: hint: hint: git branch -m Initialized empty Git repository in /content/Prism-llama.cpp/.git/ RETURN CODE: 0 ================================================================================================================ ADD PRISM REMOTE ================================================================================================================ COMMAND: 'git' '-C' '/content/Prism-llama.cpp' 'remote' 'add' 'origin' 'https://github.com/PrismML-Eng/llama.cpp.git' RETURN CODE: 0 ================================================================================================================ FETCH EXACT PRISM COMMIT ================================================================================================================ COMMAND: 'git' '-C' '/content/Prism-llama.cpp' 'fetch' '--depth' '1' 'origin' '7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f' From https://github.com/PrismML-Eng/llama.cpp * branch 7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f -> FETCH_HEAD RETURN CODE: 0 ================================================================================================================ CHECK OUT EXACT PRISM COMMIT ================================================================================================================ COMMAND: 'git' '-C' '/content/Prism-llama.cpp' 'checkout' '--detach' 'FETCH_HEAD' HEAD is now at 7529fda force qwen35 to treat IGPU like a GPU so DSpark does not fall back to CPU (#88) RETURN CODE: 0 ================================================================================================================ SOURCE CHECKOUT ================================================================================================================ Resolved commit: 7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f Detached checkout: True Working tree clean: True Commit information: commit 7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f Author: Thad Reber AuthorDate: Sun Jul 19 23:50:54 2026 -0700 Commit: GitHub CommitDate: Sun Jul 19 23:50:54 2026 -0700 force qwen35 to treat IGPU like a GPU so DSpark does not fall back to CPU (#88) ================================================================================================================ CMAKE CONFIGURATION ================================================================================================================ COMMAND: 'cmake' '-S' '/content/Prism-llama.cpp' '-B' '/content/Prism-llama.cpp/build' '-G' 'Ninja' '-DCMAKE_BUILD_TYPE=Release' '-DGGML_CUDA=ON' '-DCMAKE_CUDA_ARCHITECTURES=89' '-DLLAMA_BUILD_COMMON=ON' '-DLLAMA_BUILD_EXAMPLES=ON' '-DLLAMA_BUILD_TOOLS=ON' '-DLLAMA_BUILD_SERVER=ON' '-DLLAMA_BUILD_TESTS=ON' '-DBUILD_TESTING=ON' '-DLLAMA_BUILD_UI=OFF' '-DLLAMA_FATAL_WARNINGS=OFF' '-DGGML_CCACHE=ON' '-DLLAMA_OPENSSL=ON' -- The C compiler identification is GNU 11.4.0 -- The CXX compiler identification is GNU 11.4.0 -- Detecting C compiler ABI info -- Detecting C compiler ABI info - done -- Check for working C compiler: /usr/bin/cc - skipped -- Detecting C compile features -- Detecting C compile features - done -- Detecting CXX compiler ABI info -- Detecting CXX compiler ABI info - done -- Check for working CXX compiler: /usr/bin/c++ - skipped -- Detecting CXX compile features -- Detecting CXX compile features - done CMAKE_BUILD_TYPE=Release -- Found Git: /usr/bin/git (found version "2.34.1") -- The ASM compiler identification is GNU -- Found assembler: /usr/bin/cc -- Performing Test CMAKE_HAVE_LIBC_PTHREAD -- Performing Test CMAKE_HAVE_LIBC_PTHREAD - Success -- Found Threads: TRUE -- ccache found, compilation results will be cached. Disable with GGML_CCACHE=OFF. -- CMAKE_SYSTEM_PROCESSOR: x86_64 -- GGML_SYSTEM_ARCH: x86 -- Found OpenMP_C: -fopenmp (found version "4.5") -- Found OpenMP_CXX: -fopenmp (found version "4.5") -- Found OpenMP: TRUE (found version "4.5") -- Including CPU backend -- x86 detected -- Adding CPU backend variant ggml-cpu: -march=native -- Found CUDAToolkit: /usr/local/cuda/targets/x86_64-linux/include (found version "12.8.93") -- CUDA Toolkit found -- The CUDA compiler identification is NVIDIA 12.8.93 with host compiler GNU 11.4.0 -- Detecting CUDA compiler ABI info -- Detecting CUDA compiler ABI info - done -- Check for working CUDA compiler: /usr/local/cuda/bin/nvcc - skipped -- Detecting CUDA compile features -- Detecting CUDA compile features - done -- Using CMAKE_CUDA_ARCHITECTURES=89 CMAKE_CUDA_ARCHITECTURES_NATIVE=89-real -- Found NCCL: /usr/lib/x86_64-linux-gnu/libnccl.so -- CUDA host compiler is GNU 11.4.0 -- Including CUDA backend -- ggml version: 0.13.1 -- ggml commit: 7529fda -- Found OpenSSL: /usr/lib/x86_64-linux-gnu/libcrypto.so (found version "3.0.2") -- Performing Test OPENSSL_VERSION_SUPPORTED -- Performing Test OPENSSL_VERSION_SUPPORTED - Success -- OpenSSL found: 3.0.2 -- Generating embedded license file for target: llama-app -- Configuring done (5.2s) -- Generating done (0.2s) -- Build files have been written to: /content/Prism-llama.cpp/build RETURN CODE: 0 ================================================================================================================ REQUIRED BUILD TARGETS ================================================================================================================ [FOUND] llama-cli [FOUND] llama-completion [FOUND] llama-server [FOUND] llama-finetune [FOUND] llama-export-lora [FOUND] test-backend-ops ================================================================================================================ BUILD PRISM CUDA TARGETS ================================================================================================================ COMMAND: 'cmake' '--build' '/content/Prism-llama.cpp/build' '--parallel' '2' '--target' 'llama-cli' 'llama-completion' 'llama-server' 'llama-finetune' 'llama-export-lora' 'test-backend-ops' [1/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml.cpp.o [2/451] Building C object ggml/src/CMakeFiles/ggml-base.dir/ggml-alloc.c.o [3/451] Building C object ggml/src/CMakeFiles/ggml-base.dir/ggml.c.o [4/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml-backend.cpp.o [5/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml-opt.cpp.o [6/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml-threading.cpp.o [7/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml-backend-meta.cpp.o [8/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/gguf.cpp.o [9/451] Building C object ggml/src/CMakeFiles/ggml-base.dir/ggml-quants.c.o [10/451] Linking CXX shared library bin/libggml-base.so.0.13.1 [11/451] Creating library symlink bin/libggml-base.so.0 bin/libggml-base.so [12/451] Building CXX object ggml/src/CMakeFiles/ggml.dir/ggml-backend-dl.cpp.o [13/451] Building CXX object ggml/src/CMakeFiles/ggml.dir/ggml-backend-reg.cpp.o [14/451] Building C object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/ggml-cpu.c.o [15/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/ggml-cpu.cpp.o [16/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/hbm.cpp.o [17/451] Building C object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/quants.c.o [18/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/traits.cpp.o [19/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/amx/amx.cpp.o [20/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/amx/mmq.cpp.o [21/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/repack.cpp.o [22/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/binary-ops.cpp.o [23/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/vec.cpp.o [24/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/unary-ops.cpp.o [25/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/llamafile/sgemm.cpp.o [26/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/ops.cpp.o [27/451] Building C object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/arch/x86/quants.c.o [28/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/acc.cu.o [29/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/arch/x86/repack.cpp.o [30/451] Linking CXX shared library bin/libggml-cpu.so.0.13.1 [31/451] Creating library symlink bin/libggml-cpu.so.0 bin/libggml-cpu.so [32/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/add-id.cu.o [33/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/allreduce.cu.o [34/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/arange.cu.o [35/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/argmax.cu.o [36/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/binbcast.cu.o [37/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/clamp.cu.o [38/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/concat.cu.o [39/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/conv-transpose-1d.cu.o [40/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/conv2d-dw.cu.o [41/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/argsort.cu.o [42/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/conv2d-transpose.cu.o [43/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/conv2d.cu.o [44/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/convert.cu.o [45/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/count-equal.cu.o [46/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/cross-entropy-loss.cu.o [47/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/cpy.cu.o [48/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/diag.cu.o [49/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/cumsum.cu.o [50/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/diagmask.cu.o [51/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fattn-tile.cu.o [52/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fattn-wmma-f16.cu.o [53/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fill.cu.o [54/451] Building CXX object src/CMakeFiles/llama.dir/llama-memory.cpp.o [55/451] Building CXX object src/CMakeFiles/llama.dir/llama-memory-hybrid.cpp.o [56/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fwht.cu.o [57/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/gated_delta_net.cu.o [58/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fattn.cu.o [59/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/getrows.cu.o [60/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/ggml-cuda.cu.o [61/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/gla.cu.o [62/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/im2col.cu.o [63/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmf.cu.o [64/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mean.cu.o [65/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmid.cu.o [66/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmq-hopper-q1.cu.o [67/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmvf.cu.o [68/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmq.cu.o [69/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/norm.cu.o [70/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/opt-step-adamw.cu.o [71/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/opt-step-sgd.cu.o [72/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/out-prod.cu.o [73/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/pad.cu.o [74/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/pad_reflect_1d.cu.o [75/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/pool2d.cu.o [76/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmvq.cu.o [77/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/quantize.cu.o [78/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/roll.cu.o [79/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/scale.cu.o [80/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/rope.cu.o [81/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/set.cu.o [82/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/set-rows.cu.o [83/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/snake.cu.o [84/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/softcap.cu.o [85/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/softmax.cu.o [86/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/solve_tri.cu.o [87/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/ssm-conv.cu.o [88/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/ssm-scan.cu.o [89/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/sum.cu.o [90/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/sumrows.cu.o [91/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/top-k.cu.o [92/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/topk-moe.cu.o [93/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/tri.cu.o [94/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/tsembd.cu.o [95/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/upscale.cu.o [96/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/unary.cu.o [97/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/wkv.cu.o [98/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq112-dv112.cu.o [99/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq192-dv128.cu.o [100/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq128-dv128.cu.o [101/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq320-dv256.cu.o [102/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq40-dv40.cu.o [103/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq512-dv512.cu.o [104/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq256-dv256.cu.o [105/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq576-dv512.cu.o [106/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq64-dv64.cu.o [107/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq72-dv72.cu.o [108/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq80-dv80.cu.o [109/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_1-ncols2_16.cu.o [110/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq96-dv96.cu.o [111/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_1-ncols2_32.cu.o [112/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_1-ncols2_8.cu.o [113/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_16-ncols2_1.cu.o [114/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_16-ncols2_2.cu.o [115/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_2-ncols2_16.cu.o [116/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_2-ncols2_32.cu.o [117/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_16-ncols2_4.cu.o [118/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_2-ncols2_4.cu.o [119/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_2-ncols2_8.cu.o [120/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_32-ncols2_2.cu.o [121/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_32-ncols2_1.cu.o [122/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_4-ncols2_16.cu.o [123/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_4-ncols2_2.cu.o [124/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_4-ncols2_4.cu.o [125/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_4-ncols2_8.cu.o [126/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_64-ncols2_1.cu.o [127/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_8-ncols2_1.cu.o [128/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_8-ncols2_2.cu.o [129/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_8-ncols2_4.cu.o [130/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_8-ncols2_8.cu.o [131/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq1_s.cu.o [132/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq2_s.cu.o [133/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq2_xs.cu.o [134/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq2_xxs.cu.o [135/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq3_s.cu.o [136/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq3_xxs.cu.o [137/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq4_nl.cu.o [138/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq4_xs.cu.o [139/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-mxfp4.cu.o [140/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-nvfp4.cu.o [141/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q1_0.cu.o [142/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q2_0.cu.o [143/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q2_k.cu.o [144/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q3_k.cu.o [145/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/caps.cpp.o [146/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q4_0.cu.o [147/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q4_1.cu.o [148/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q4_k.cu.o [149/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q5_0.cu.o [150/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q5_1.cu.o [151/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q5_k.cu.o [152/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q8_0.cu.o [153/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q6_k.cu.o [154/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_1.cu.o [155/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_10.cu.o [156/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_11.cu.o [157/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_12.cu.o [158/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_13.cu.o [159/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_14.cu.o [160/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_15.cu.o [161/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_16.cu.o [162/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_2.cu.o [163/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_3.cu.o [164/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_4.cu.o [165/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_5.cu.o [166/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_6.cu.o [167/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_7.cu.o [168/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_8.cu.o [169/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_9.cu.o [170/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-vec-instance-f16-f16.cu.o [171/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-vec-instance-q4_0-q4_0.cu.o [172/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-vec-instance-q8_0-q8_0.cu.o [173/451] Building CXX object src/CMakeFiles/llama.dir/llama.cpp.o [174/451] Building CXX object src/CMakeFiles/llama.dir/llama-adapter.cpp.o [175/451] Building CXX object src/CMakeFiles/llama.dir/llama-arch.cpp.o [176/451] Building CXX object src/CMakeFiles/llama.dir/llama-batch.cpp.o [177/451] Building CXX object src/CMakeFiles/llama.dir/llama-chat.cpp.o [178/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-vec-instance-bf16-bf16.cu.o [179/451] Linking CUDA shared library bin/libggml-cuda.so.0.13.1 [180/451] Creating library symlink bin/libggml-cuda.so.0 bin/libggml-cuda.so [181/451] Linking CXX shared library bin/libggml.so.0.13.1 [182/451] Creating library symlink bin/libggml.so.0 bin/libggml.so [183/451] Building CXX object src/CMakeFiles/llama.dir/llama-cparams.cpp.o [184/451] Building CXX object src/CMakeFiles/llama.dir/llama-context.cpp.o [185/451] Building CXX object src/CMakeFiles/llama.dir/llama-graph.cpp.o [186/451] Building CXX object src/CMakeFiles/llama.dir/llama-hparams.cpp.o [187/451] Building CXX object src/CMakeFiles/llama.dir/llama-impl.cpp.o [188/451] Building CXX object src/CMakeFiles/llama.dir/llama-io.cpp.o [189/451] Building CXX object src/CMakeFiles/llama.dir/llama-grammar.cpp.o [190/451] Building CXX object src/CMakeFiles/llama.dir/llama-kv-cache-iswa.cpp.o [191/451] Building CXX object src/CMakeFiles/llama.dir/llama-kv-cache-dsa.cpp.o [192/451] Building CXX object src/CMakeFiles/llama.dir/llama-memory-hybrid-iswa.cpp.o [193/451] Building CXX object src/CMakeFiles/llama.dir/llama-kv-cache.cpp.o [194/451] Building CXX object src/CMakeFiles/llama.dir/llama-mmap.cpp.o [195/451] Building CXX object src/CMakeFiles/llama.dir/llama-memory-recurrent.cpp.o [196/451] Building CXX object src/CMakeFiles/llama.dir/llama-model-saver.cpp.o [197/451] Building CXX object src/CMakeFiles/llama.dir/llama-model-loader.cpp.o [198/451] Building CXX object src/CMakeFiles/llama.dir/llama-model.cpp.o [199/451] Building CXX object src/CMakeFiles/llama.dir/llama-quant.cpp.o [200/451] Building CXX object src/CMakeFiles/llama.dir/llama-sampler.cpp.o [201/451] Building CXX object src/CMakeFiles/llama.dir/unicode-data.cpp.o [202/451] Building CXX object src/CMakeFiles/llama.dir/llama-vocab.cpp.o [203/451] Building CXX object src/CMakeFiles/llama.dir/models/afmoe.cpp.o [204/451] Building CXX object src/CMakeFiles/llama.dir/models/apertus.cpp.o [205/451] Building CXX object src/CMakeFiles/llama.dir/models/arcee.cpp.o [206/451] Building CXX object src/CMakeFiles/llama.dir/models/arctic.cpp.o [207/451] Building CXX object src/CMakeFiles/llama.dir/models/arwkv7.cpp.o [208/451] Building CXX object src/CMakeFiles/llama.dir/models/baichuan.cpp.o [209/451] Building CXX object src/CMakeFiles/llama.dir/unicode.cpp.o [210/451] Building CXX object src/CMakeFiles/llama.dir/models/bailingmoe.cpp.o [211/451] Building CXX object src/CMakeFiles/llama.dir/models/bailingmoe2.cpp.o [212/451] Building CXX object src/CMakeFiles/llama.dir/models/bert.cpp.o [213/451] Building CXX object src/CMakeFiles/llama.dir/models/bitnet.cpp.o [214/451] Building CXX object src/CMakeFiles/llama.dir/models/bloom.cpp.o [215/451] Building CXX object src/CMakeFiles/llama.dir/models/chameleon.cpp.o [216/451] Building CXX object src/CMakeFiles/llama.dir/models/chatglm.cpp.o [217/451] Building CXX object src/CMakeFiles/llama.dir/models/codeshell.cpp.o [218/451] Building CXX object src/CMakeFiles/llama.dir/models/cogvlm.cpp.o [219/451] Building CXX object src/CMakeFiles/llama.dir/models/cohere2.cpp.o [220/451] Building CXX object src/CMakeFiles/llama.dir/models/command-r.cpp.o [221/451] Building CXX object src/CMakeFiles/llama.dir/models/dbrx.cpp.o [222/451] Building CXX object src/CMakeFiles/llama.dir/models/deci.cpp.o [223/451] Building CXX object src/CMakeFiles/llama.dir/models/deepseek.cpp.o [224/451] Building CXX object src/CMakeFiles/llama.dir/models/deepseek2.cpp.o [225/451] Building CXX object src/CMakeFiles/llama.dir/models/deepseek2ocr.cpp.o [226/451] Building CXX object src/CMakeFiles/llama.dir/models/deepseek32.cpp.o [227/451] Building CXX object src/CMakeFiles/llama.dir/models/delta-net-base.cpp.o [228/451] Building CXX object src/CMakeFiles/llama.dir/models/dots1.cpp.o [229/451] Building CXX object src/CMakeFiles/llama.dir/models/dream.cpp.o [230/451] Building CXX object src/CMakeFiles/llama.dir/models/dspark.cpp.o [231/451] Building CXX object src/CMakeFiles/llama.dir/models/ernie4-5-moe.cpp.o [232/451] Building CXX object src/CMakeFiles/llama.dir/models/ernie4-5.cpp.o [233/451] Building CXX object src/CMakeFiles/llama.dir/models/eurobert.cpp.o [234/451] Building CXX object src/CMakeFiles/llama.dir/models/exaone-moe.cpp.o [235/451] Building CXX object src/CMakeFiles/llama.dir/models/exaone.cpp.o [236/451] Building CXX object src/CMakeFiles/llama.dir/models/exaone4.cpp.o [237/451] Building CXX object src/CMakeFiles/llama.dir/models/falcon-h1.cpp.o [238/451] Building CXX object src/CMakeFiles/llama.dir/models/falcon.cpp.o [239/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma-embedding.cpp.o [240/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma.cpp.o [241/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma2.cpp.o [242/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma3.cpp.o [243/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma3n.cpp.o [244/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma4-assistant.cpp.o [245/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma4.cpp.o [246/451] Building CXX object src/CMakeFiles/llama.dir/models/glm-dsa.cpp.o [247/451] Building CXX object src/CMakeFiles/llama.dir/models/glm4-moe.cpp.o [248/451] Building CXX object src/CMakeFiles/llama.dir/models/glm4.cpp.o [249/451] Building CXX object src/CMakeFiles/llama.dir/models/gpt2.cpp.o [250/451] Building CXX object src/CMakeFiles/llama.dir/models/gptneox.cpp.o [251/451] Building CXX object src/CMakeFiles/llama.dir/models/granite-hybrid.cpp.o [252/451] Building CXX object src/CMakeFiles/llama.dir/models/granite-moe.cpp.o [253/451] Building CXX object src/CMakeFiles/llama.dir/models/granite.cpp.o [254/451] Building CXX object src/CMakeFiles/llama.dir/models/grok.cpp.o [255/451] Building CXX object src/CMakeFiles/llama.dir/models/grovemoe.cpp.o [256/451] Building CXX object src/CMakeFiles/llama.dir/models/hunyuan-dense.cpp.o [257/451] Building CXX object src/CMakeFiles/llama.dir/models/hunyuan-moe.cpp.o [258/451] Building CXX object src/CMakeFiles/llama.dir/models/hunyuan-vl.cpp.o [259/451] Building CXX object src/CMakeFiles/llama.dir/models/internlm2.cpp.o [260/451] Building CXX object src/CMakeFiles/llama.dir/models/jais.cpp.o [261/451] Building CXX object src/CMakeFiles/llama.dir/models/jais2.cpp.o [262/451] Building CXX object src/CMakeFiles/llama.dir/models/jamba.cpp.o [263/451] Building CXX object src/CMakeFiles/llama.dir/models/jina-bert-v2.cpp.o [264/451] Building CXX object src/CMakeFiles/llama.dir/models/jina-bert-v3.cpp.o [265/451] Building CXX object src/CMakeFiles/llama.dir/models/kimi-linear.cpp.o [266/451] Building CXX object src/CMakeFiles/llama.dir/models/lfm2.cpp.o [267/451] Building CXX object src/CMakeFiles/llama.dir/models/lfm2moe.cpp.o [268/451] Building CXX object src/CMakeFiles/llama.dir/models/llada-moe.cpp.o [269/451] Building CXX object src/CMakeFiles/llama.dir/models/llada.cpp.o [270/451] Building CXX object src/CMakeFiles/llama.dir/models/llama-embed.cpp.o [271/451] Building CXX object src/CMakeFiles/llama.dir/models/llama.cpp.o [272/451] Building CXX object src/CMakeFiles/llama.dir/models/llama4.cpp.o [273/451] Building CXX object src/CMakeFiles/llama.dir/models/maincoder.cpp.o [274/451] Building CXX object src/CMakeFiles/llama.dir/models/mamba-base.cpp.o [275/451] Building CXX object src/CMakeFiles/llama.dir/models/mamba.cpp.o [276/451] Building CXX object src/CMakeFiles/llama.dir/models/mamba2.cpp.o [277/451] Building CXX object src/CMakeFiles/llama.dir/models/mellum.cpp.o [278/451] Building CXX object src/CMakeFiles/llama.dir/models/mimo2.cpp.o [279/451] Building CXX object src/CMakeFiles/llama.dir/models/minicpm.cpp.o [280/451] Building CXX object src/CMakeFiles/llama.dir/models/minicpm3.cpp.o [281/451] Building CXX object src/CMakeFiles/llama.dir/models/minimax-m2.cpp.o [282/451] Building CXX object src/CMakeFiles/llama.dir/models/mistral3.cpp.o [283/451] Building CXX object src/CMakeFiles/llama.dir/models/mistral4.cpp.o [284/451] Building CXX object src/CMakeFiles/llama.dir/models/modern-bert.cpp.o [285/451] Building CXX object src/CMakeFiles/llama.dir/models/mpt.cpp.o [286/451] Building CXX object src/CMakeFiles/llama.dir/models/nemotron-h-moe.cpp.o [287/451] Building CXX object src/CMakeFiles/llama.dir/models/nemotron-h.cpp.o [288/451] Building CXX object src/CMakeFiles/llama.dir/models/nemotron.cpp.o [289/451] Building CXX object src/CMakeFiles/llama.dir/models/neo-bert.cpp.o [290/451] Building CXX object src/CMakeFiles/llama.dir/models/nomic-bert-moe.cpp.o [291/451] Building CXX object src/CMakeFiles/llama.dir/models/nomic-bert.cpp.o [292/451] Building CXX object src/CMakeFiles/llama.dir/models/olmo.cpp.o [293/451] Building CXX object src/CMakeFiles/llama.dir/models/olmo2.cpp.o [294/451] Building CXX object src/CMakeFiles/llama.dir/models/olmoe.cpp.o [295/451] Building CXX object src/CMakeFiles/llama.dir/models/openai-moe.cpp.o [296/451] Building CXX object src/CMakeFiles/llama.dir/models/openelm.cpp.o [297/451] Building CXX object src/CMakeFiles/llama.dir/models/paddleocr.cpp.o [298/451] Building CXX object src/CMakeFiles/llama.dir/models/orion.cpp.o [299/451] Building CXX object src/CMakeFiles/llama.dir/models/pangu-embed.cpp.o [300/451] Building CXX object src/CMakeFiles/llama.dir/models/phi2.cpp.o [301/451] Building CXX object src/CMakeFiles/llama.dir/models/phimoe.cpp.o [302/451] Building CXX object src/CMakeFiles/llama.dir/models/phi3.cpp.o [303/451] Building CXX object src/CMakeFiles/llama.dir/models/plamo.cpp.o [304/451] Building CXX object src/CMakeFiles/llama.dir/models/plamo2.cpp.o [305/451] Building CXX object src/CMakeFiles/llama.dir/models/plamo3.cpp.o [306/451] Building CXX object src/CMakeFiles/llama.dir/models/plm.cpp.o [307/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen.cpp.o [308/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen2.cpp.o [309/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen2moe.cpp.o [310/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen2vl.cpp.o [311/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3.cpp.o [312/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen35.cpp.o [313/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen35moe.cpp.o [314/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3moe.cpp.o [315/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3next.cpp.o [316/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3vl.cpp.o [317/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3vlmoe.cpp.o [318/451] Building CXX object src/CMakeFiles/llama.dir/models/refact.cpp.o [319/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv6-base.cpp.o [320/451] Building CXX object src/CMakeFiles/llama.dir/models/rnd1.cpp.o [321/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv6qwen2.cpp.o [322/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv6.cpp.o [323/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv7-base.cpp.o [324/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv7.cpp.o [325/451] Building CXX object src/CMakeFiles/llama.dir/models/seed-oss.cpp.o [326/451] Building CXX object src/CMakeFiles/llama.dir/models/smallthinker.cpp.o [327/451] Building CXX object src/CMakeFiles/llama.dir/models/smollm3.cpp.o [328/451] Building CXX object src/CMakeFiles/llama.dir/models/stablelm.cpp.o [329/451] Building CXX object src/CMakeFiles/llama.dir/models/starcoder.cpp.o [330/451] Building CXX object src/CMakeFiles/llama.dir/models/starcoder2.cpp.o [331/451] Building CXX object src/CMakeFiles/llama.dir/models/step35.cpp.o [332/451] Building CXX object src/CMakeFiles/llama.dir/models/t5.cpp.o [333/451] Building CXX object src/CMakeFiles/llama.dir/models/t5encoder.cpp.o [334/451] Building CXX object src/CMakeFiles/llama.dir/models/talkie.cpp.o [335/451] Building CXX object src/CMakeFiles/llama.dir/models/wavtokenizer-dec.cpp.o [336/451] Building CXX object src/CMakeFiles/llama.dir/models/xverse.cpp.o [337/451] Building CXX object common/CMakeFiles/llama-common-base.dir/build-info.cpp.o [338/451] Linking CXX static library common/libllama-common-base.a [339/451] Linking CXX shared library bin/libllama.so.0.0.1 [340/451] Creating library symlink bin/libllama.so.0 bin/libllama.so [341/451] Building CXX object common/CMakeFiles/llama-common.dir/chat-auto-parser-generator.cpp.o [342/451] Building CXX object common/CMakeFiles/llama-common.dir/chat-auto-parser-helpers.cpp.o [343/451] Building CXX object common/CMakeFiles/llama-common.dir/arg.cpp.o [344/451] Building CXX object common/CMakeFiles/llama-common.dir/chat-diff-analyzer.cpp.o [345/451] Building CXX object common/CMakeFiles/llama-common.dir/chat-peg-parser.cpp.o [346/451] Building CXX object common/CMakeFiles/llama-common.dir/common.cpp.o [347/451] Building CXX object common/CMakeFiles/llama-common.dir/console.cpp.o [348/451] Building CXX object common/CMakeFiles/llama-common.dir/chat.cpp.o [349/451] Building CXX object common/CMakeFiles/llama-common.dir/debug.cpp.o [350/451] Building CXX object common/CMakeFiles/llama-common.dir/fit.cpp.o [351/451] Building CXX object common/CMakeFiles/llama-common.dir/download.cpp.o [352/451] Building CXX object common/CMakeFiles/llama-common.dir/imatrix-loader.cpp.o [353/451] Building CXX object common/CMakeFiles/llama-common.dir/hf-cache.cpp.o [354/451] Building CXX object common/CMakeFiles/llama-common.dir/json-partial.cpp.o [355/451] Building CXX object common/CMakeFiles/llama-common.dir/kv-mean-center.cpp.o [356/451] Building CXX object common/CMakeFiles/llama-common.dir/llguidance.cpp.o [357/451] Building CXX object common/CMakeFiles/llama-common.dir/log.cpp.o [358/451] Building CXX object common/CMakeFiles/llama-common.dir/json-schema-to-grammar.cpp.o [359/451] Building CXX object common/CMakeFiles/llama-common.dir/ngram-cache.cpp.o [360/451] Building CXX object common/CMakeFiles/llama-common.dir/ngram-map.cpp.o [361/451] Building CXX object common/CMakeFiles/llama-common.dir/ngram-mod.cpp.o [362/451] Building CXX object common/CMakeFiles/llama-common.dir/preset.cpp.o [363/451] Building CXX object common/CMakeFiles/llama-common.dir/regex-partial.cpp.o [364/451] Building CXX object common/CMakeFiles/llama-common.dir/reasoning-budget.cpp.o [365/451] Building CXX object common/CMakeFiles/llama-common.dir/sampling.cpp.o [366/451] Building CXX object common/CMakeFiles/llama-common.dir/speculative.cpp.o [367/451] Building CXX object common/CMakeFiles/llama-common.dir/peg-parser.cpp.o [368/451] Building CXX object common/CMakeFiles/llama-common.dir/unicode.cpp.o [369/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/lexer.cpp.o [370/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/parser.cpp.o [371/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/runtime.cpp.o [372/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/string.cpp.o [373/451] Building CUDA object common/CMakeFiles/llama-common.dir/dspark-markov.cu.o [374/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/value.cpp.o [375/451] Building CXX object vendor/cpp-httplib/CMakeFiles/cpp-httplib.dir/httplib.cpp.o [376/451] Linking CXX static library vendor/cpp-httplib/libcpp-httplib.a [377/451] Linking CXX shared library bin/libllama-common.so.0.0.1 [378/451] Creating library symlink bin/libllama-common.so.0 bin/libllama-common.so [379/451] Building CXX object tests/CMakeFiles/test-backend-ops.dir/get-model.cpp.o [380/451] Building CXX object examples/training/CMakeFiles/llama-finetune.dir/finetune.cpp.o [381/451] Linking CXX executable bin/llama-finetune [382/451] Building CXX object tests/CMakeFiles/test-backend-ops.dir/test-backend-ops.cpp.o [383/451] Linking CXX executable bin/test-backend-ops [384/451] Building CXX object tools/completion/CMakeFiles/llama-completion.dir/main.cpp.o [385/451] Building CXX object tools/ui/CMakeFiles/llama-ui-embed.dir/embed.cpp.o [386/451] Linking CXX executable tools/ui/llama-ui-embed [387/451] Building CXX object tools/completion/CMakeFiles/llama-completion-impl.dir/completion.cpp.o [388/451] Linking CXX shared library bin/libllama-completion-impl.so [389/451] Linking CXX executable bin/llama-completion [390/451] Provisioning UI assets -- UI: downloading from b1: https://huggingface.co/buckets/ggml-org/llama-ui/resolve/b1 -- UI: download bundle.css from b1 failed: "HTTP response code said error" -- UI: downloading from latest: https://huggingface.co/buckets/ggml-org/llama-ui/resolve/latest -- UI: download bundle.css from latest failed: "HTTP response code said error" -- UI: HF download failed CMake Warning at /content/Prism-llama.cpp/scripts/ui-assets.cmake:348 (message): UI: no assets available - building without an embedded UI. In a disconnected environment, download the pre-built UI from a llama.cpp release at https://github.com/ggml-org/llama.cpp/releases and extract to tools/ui/dist. [391/451] Building CXX object tools/ui/CMakeFiles/llama-ui.dir/ui.cpp.o [392/451] Linking CXX static library tools/ui/libllama-ui.a [393/451] Building CXX object tools/cli/CMakeFiles/llama-cli.dir/main.cpp.o [394/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-chat.cpp.o [395/451] Building CXX object tools/cli/CMakeFiles/llama-cli-impl.dir/cli.cpp.o [396/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-queue.cpp.o [397/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-task.cpp.o [398/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-common.cpp.o [399/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-tools.cpp.o [400/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-context.cpp.o [401/451] Building CXX object tools/server/CMakeFiles/llama-server-impl.dir/server.cpp.o [402/451] Building CXX object tools/server/CMakeFiles/llama-server-impl.dir/server-http.cpp.o [403/451] Building CXX object tools/server/CMakeFiles/llama-server.dir/main.cpp.o [404/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/mtmd.cpp.o [405/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/mtmd-audio.cpp.o [406/451] Building CXX object tools/server/CMakeFiles/llama-server-impl.dir/server-models.cpp.o [407/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/mtmd-image.cpp.o [408/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/clip.cpp.o [409/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/cogvlm.cpp.o [410/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/mtmd-helper.cpp.o [411/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/conformer.cpp.o [412/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/dotsocr.cpp.o [413/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/exaone4_5.cpp.o [414/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/gemma4a.cpp.o [415/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/gemma4v.cpp.o [416/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/gemma4ua.cpp.o [417/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/gemma4uv.cpp.o [418/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/glm4v.cpp.o [419/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/granite-speech.cpp.o [420/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/granite4-vision.cpp.o [421/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/hunyuanvl.cpp.o [422/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/internvl.cpp.o [423/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/kimivl.cpp.o [424/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/kimik25.cpp.o [425/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/nemotron-v2-vl.cpp.o [426/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/llama4.cpp.o [427/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/llava.cpp.o [428/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/minicpmv.cpp.o [429/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/paddleocr.cpp.o [430/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/pixtral.cpp.o [431/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/qwen2vl.cpp.o [432/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/qwen3vl.cpp.o [433/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/mimovl.cpp.o [434/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/qwen3a.cpp.o [435/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/step3vl.cpp.o [436/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/siglip.cpp.o [437/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/whisper-enc.cpp.o [438/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/deepseekocr.cpp.o [439/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/deepseekocr2.cpp.o [440/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/mobilenetv5.cpp.o [441/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/youtuvl.cpp.o [442/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/yasa2.cpp.o [443/451] Linking CXX shared library bin/libmtmd.so.0.0.1 [444/451] Creating library symlink bin/libmtmd.so.0 bin/libmtmd.so [445/451] Linking CXX static library tools/server/libserver-context.a [446/451] Linking CXX shared library bin/libllama-cli-impl.so [447/451] Linking CXX executable bin/llama-cli [448/451] Linking CXX shared library bin/libllama-server-impl.so [449/451] Linking CXX executable bin/llama-server [450/451] Building CXX object tools/export-lora/CMakeFiles/llama-export-lora.dir/export-lora.cpp.o [451/451] Linking CXX executable bin/llama-export-lora RETURN CODE: 0 ================================================================================================================ BUILT BINARIES ================================================================================================================ [PASS] llama-cli: /content/Prism-llama.cpp/build/bin/llama-cli size=17,888 bytes sha256=bdbd81034512fdc6ae4a674a67ed50adb87c46b134b708609978880b0fc8a24c [PASS] llama-completion: /content/Prism-llama.cpp/build/bin/llama-completion size=15,968 bytes sha256=698bdd659e5d1332ecc9da02448d60cfa650f8cbc754df5aa90f8da5c3d218b3 [PASS] llama-server: /content/Prism-llama.cpp/build/bin/llama-server size=17,896 bytes sha256=903526b58a5cc21e208382f3f6d3d6ee272c9307908955fd2088aaa26d5fb3ab [PASS] llama-finetune: /content/Prism-llama.cpp/build/bin/llama-finetune size=40,648 bytes sha256=f33b406af0091902ebe1ee183165b9f1f9cdb69206b96e08eda764a274cf158a [PASS] llama-export-lora: /content/Prism-llama.cpp/build/bin/llama-export-lora size=89,592 bytes sha256=ec09b5231dc60859c4955d2bd88c3f84dd1b8421a4d8444ae5ab1b83130559ad [PASS] test-backend-ops: /content/Prism-llama.cpp/build/bin/test-backend-ops size=1,157,008 bytes sha256=dc031c693d34dba11ae49a680e98d1ed66b1075daf4a14fb8d68a05408bb4506 ================================================================================================================ BINARY SMOKE TESTS ================================================================================================================ llama-cli: return_code=0 ----- common params ----- -h, --help, --usage print usage and exit --version show version and build info -cl, --cache-list show list of models in cache --completion-bash print source-able bash completion script for llama.cpp -t, --threads N number of CPU threads to use during generation (default: -1) (env: LLAMA_ARG_THREADS) -tb, --threads-batch N number of threads to use during batch and prompt processing (default: same as --threads) -C, --cpu-mask M CPU affinity mask: arbitrarily long hex. Complements cpu-range (default: "") -Cr, --cpu-range lo-hi range of CPUs for affinity. Complements --cpu-mask --cpu-strict <0|1> use strict CPU placement (default: 0) --prio N set process/thread priority : low(-1), normal(0), medium(1), high(2), realtime(3) (default: 0) --poll <0...100> use polling level to wait for work (0 - no polling, default: 50) -Cb, --cpu-mask-batch M CPU affinity mask: arbitrarily long hex. Complements cpu-range-batch (default: same as --cpu-mask) -Crb, --cpu-range-batch lo-hi ranges of CPUs for affinity. Complements --cpu-mask-batch --cpu-strict-batch <0|1> use strict CPU placement (default: same as --cpu-strict) --prio-batch N set process/thread priority : 0-normal, 1-medium, 2-high, 3-realtime (default: 0) --poll-batch <0|1> use polling to wait for work (default: same as --poll) -c, --ctx-size N size of the prompt context (default: 0, 0 = loaded from model) (env: LLAMA_ARG_CTX_SIZE) -n, --predict, --n-predict N number of tokens to predict (default: -1, -1 = infinity) (env: LLAMA_ARG_N_PREDICT) -b, --batch-size N logical maximum batch size (default: 2048) (env: LLAMA_ARG_BATCH) llama-completion: return_code=0 ----- common params ----- -h, --help, --usage print usage and exit --version show version and build info -cl, --cache-list show list of models in cache --completion-bash print source-able bash completion script for llama.cpp -t, --threads N number of CPU threads to use during generation (default: -1) (env: LLAMA_ARG_THREADS) -tb, --threads-batch N number of threads to use during batch and prompt processing (default: same as --threads) -C, --cpu-mask M CPU affinity mask: arbitrarily long hex. Complements cpu-range (default: "") -Cr, --cpu-range lo-hi range of CPUs for affinity. Complements --cpu-mask --cpu-strict <0|1> use strict CPU placement (default: 0) --prio N set process/thread priority : low(-1), normal(0), medium(1), high(2), realtime(3) (default: 0) --poll <0...100> use polling level to wait for work (0 - no polling, default: 50) -Cb, --cpu-mask-batch M CPU affinity mask: arbitrarily long hex. Complements cpu-range-batch (default: same as --cpu-mask) -Crb, --cpu-range-batch lo-hi ranges of CPUs for affinity. Complements --cpu-mask-batch --cpu-strict-batch <0|1> use strict CPU placement (default: same as --cpu-strict) --prio-batch N set process/thread priority : 0-normal, 1-medium, 2-high, 3-realtime (default: 0) --poll-batch <0|1> use polling to wait for work (default: same as --poll) -c, --ctx-size N size of the prompt context (default: 0, 0 = loaded from model) (env: LLAMA_ARG_CTX_SIZE) -n, --predict, --n-predict N number of tokens to predict (default: -1, -1 = infinity, -2 = until context filled) (env: LLAMA_ARG_N_PREDICT) -b, --batch-size N logical maximum batch size (default: 2048) llama-finetune: return_code=0 ----- common params ----- -h, --help, --usage print usage and exit --version show version and build info -cl, --cache-list show list of models in cache --completion-bash print source-able bash completion script for llama.cpp -t, --threads N number of CPU threads to use during generation (default: -1) (env: LLAMA_ARG_THREADS) -tb, --threads-batch N number of threads to use during batch and prompt processing (default: same as --threads) -C, --cpu-mask M CPU affinity mask: arbitrarily long hex. Complements cpu-range (default: "") -Cr, --cpu-range lo-hi range of CPUs for affinity. Complements --cpu-mask --cpu-strict <0|1> use strict CPU placement (default: 0) --prio N set process/thread priority : low(-1), normal(0), medium(1), high(2), realtime(3) (default: 0) --poll <0...100> use polling level to wait for work (0 - no polling, default: 50) -Cb, --cpu-mask-batch M CPU affinity mask: arbitrarily long hex. Complements cpu-range-batch (default: same as --cpu-mask) -Crb, --cpu-range-batch lo-hi ranges of CPUs for affinity. Complements --cpu-mask-batch --cpu-strict-batch <0|1> use strict CPU placement (default: same as --cpu-strict) --prio-batch N set process/thread priority : 0-normal, 1-medium, 2-high, 3-realtime (default: 0) --poll-batch <0|1> use polling to wait for work (default: same as --poll) -c, --ctx-size N size of the prompt context (default: 0, 0 = loaded from model) (env: LLAMA_ARG_CTX_SIZE) -n, --predict, --n-predict N number of tokens to predict (default: -1, -1 = infinity) (env: LLAMA_ARG_N_PREDICT) -b, --batch-size N logical maximum batch size (default: 2048) (env: LLAMA_ARG_BATCH) llama-export-lora: return_code=0 ----- common params ----- -h, --help, --usage print usage and exit --version show version and build info -cl, --cache-list show list of models in cache --completion-bash print source-able bash completion script for llama.cpp -t, --threads N number of CPU threads to use during generation (default: -1) (env: LLAMA_ARG_THREADS) -tb, --threads-batch N number of threads to use during batch and prompt processing (default: same as --threads) -C, --cpu-mask M CPU affinity mask: arbitrarily long hex. Complements cpu-range (default: "") -Cr, --cpu-range lo-hi range of CPUs for affinity. Complements --cpu-mask --cpu-strict <0|1> use strict CPU placement (default: 0) --prio N set process/thread priority : low(-1), normal(0), medium(1), high(2), realtime(3) (default: 0) --poll <0...100> use polling level to wait for work (0 - no polling, default: 50) -Cb, --cpu-mask-batch M CPU affinity mask: arbitrarily long hex. Complements cpu-range-batch (default: same as --cpu-mask) -Crb, --cpu-range-batch lo-hi ranges of CPUs for affinity. Complements --cpu-mask-batch --cpu-strict-batch <0|1> use strict CPU placement (default: same as --cpu-strict) --prio-batch N set process/thread priority : 0-normal, 1-medium, 2-high, 3-realtime (default: 0) --poll-batch <0|1> use polling to wait for work (default: same as --poll) -c, --ctx-size N size of the prompt context (default: 0, 0 = loaded from model) (env: LLAMA_ARG_CTX_SIZE) -n, --predict, --n-predict N number of tokens to predict (default: -1, -1 = infinity) (env: LLAMA_ARG_N_PREDICT) -b, --batch-size N logical maximum batch size (default: 2048) (env: LLAMA_ARG_BATCH) test-backend-ops: return_code=1 Usage: /content/Prism-llama.cpp/build/bin/test-backend-ops [mode] [-o ] [-b ] [-p ] [--output ] [--list-ops] [--show-coverage] [--test-file ] [-j ] valid modes: - test (default, compare with CPU backend for correctness) - grad (compare gradients from backpropagation with method of finite differences) - perf (performance evaluation) - support (probe backend operation support) op names for -o are as given by ggml_op_desc() (e.g. ADD, MUL_MAT, etc), optionally including the full test case string (e.g. "ADD(type=f16,ne=[1,1,8,1],nr=[1,1,1,1],nf=1)") --output specifies output format (default: console, options: console, sql, csv) --list-ops lists all available GGML operations --show-coverage shows test coverage --test-file reads test operators from a test file generated by llama-export-graph-ops -j runs tests using parallel worker threads (default: 1, test mode only) ================================================================================================================ SOURCE HASH BASELINE ================================================================================================================ 8fe7c384f84fcb9c0b396f2aba9122c0a9f0172260f7a7bd4bedfdd2c627f171 ggml/src/ggml-cuda/mmq.cu ab36e05057c754f016ef229f478d9c871e2bb1502c1059bc21e7f777b80bb83a ggml/src/ggml-cuda/mmq.cuh 637928070f54fd92749b83bd1ebce2bf101ad9fe3989afe52ab48dcefc9855b4 ggml/src/ggml-cuda/out-prod.cu e91732f059f13cbb4ef62ed4435738db5d22e24d77bad7f727d5b7919beadfcf ggml/src/ggml-cuda/ggml-cuda.cu 24a0615d0feb09b6041528215bef01cc0c2aba35b8cd49f8164ace49abb1a997 ggml/src/ggml.c d1f710b1ea3aa0f7da5f698a8a6a7e3b19adfc87c329ebc0b70ee0ac667efa4c tests/test-backend-ops.cpp 276e5410995dab8ca4cbb8448270c59836488e22be916e2004cc4fb1129ebd17 examples/training/finetune.cpp f593edae28d12e4ed59c7211e74779680b9af28f34f590103f446d659874681b src/llama-adapter.cpp ================================================================================================================ CMAKE CACHE SUMMARY ================================================================================================================ BUILD_TESTING:BOOL=ON CMAKE_BUILD_TYPE:STRING=Release CMAKE_CUDA_ARCHITECTURES:UNINITIALIZED=89 GGML_CCACHE:BOOL=ON GGML_CCACHE_FOUND:FILEPATH=/usr/bin/ccache GGML_CUDA:BOOL=ON GGML_CUDA_COMPRESSION_MODE:STRING=size GGML_CUDA_CUTLASS_DIR:PATH= GGML_CUDA_FA:BOOL=ON GGML_CUDA_FA_ALL_QUANTS:BOOL=OFF GGML_CUDA_FORCE_CUBLAS:BOOL=OFF GGML_CUDA_FORCE_MMQ:BOOL=OFF GGML_CUDA_GRAPHS:BOOL=ON GGML_CUDA_HOPPER_Q1:BOOL=OFF GGML_CUDA_NCCL:BOOL=ON GGML_CUDA_NO_PEER_COPY:BOOL=OFF GGML_CUDA_NO_VMM:BOOL=OFF GGML_CUDA_PEER_MAX_BATCH_SIZE:STRING=128 LLAMA_BUILD_COMMON:BOOL=ON LLAMA_BUILD_EXAMPLES:BOOL=ON LLAMA_BUILD_SERVER:BOOL=ON LLAMA_BUILD_TESTS:BOOL=ON LLAMA_BUILD_TOOLS:BOOL=ON GGML_CUDA_COMPRESSION_MODE-STRINGS:INTERNAL=none;speed;balance;size ================================================================================================================ CCACHE SUMMARY ================================================================================================================ Summary: Hits: 0 / 422 (0.00 %) Direct: 0 / 422 (0.00 %) Preprocessed: 0 / 422 (0.00 %) Misses: 422 Direct: 422 Preprocessed: 422 Primary storage: Hits: 0 / 844 (0.00 %) Misses: 844 Cache size (GB): 0.06 / 10.00 (0.63 %) Use the -v/--verbose option for more details. Return code: 0 ================================================================================================================ FINAL GIT STATE ================================================================================================================ Working tree status: Status command return code: 0 ================================================================================================================ FINAL RESULT ================================================================================================================ [PASS] Fresh Colab dependencies installed. [PASS] CUDA runtime and nvcc verified. [PASS] Official Prism repository fetched. [PASS] Exact Prism commit verified. [PASS] Clean detached source checkout created. [PASS] CUDA SM architecture configured. [PASS] Examples, tools, server and tests enabled. [PASS] llama-cli built. [PASS] llama-completion built. [PASS] llama-server built. [PASS] llama-finetune built. [PASS] llama-export-lora built. [PASS] test-backend-ops built. [PASS] Source hash baseline recorded. [PASS] Project configuration written. [PASS] Reusable path helper written. Status: PASS Elapsed: 33:26 No Prism source patches have been applied. No model has been downloaded. No training has been started. The next implementation stage is the isolated exact training-forward primitive: packed Q1 weight × F32 activation -> F32 output with Q1 signs/scales decoded only inside the CUDA kernel.