|
|
| ================================================================================================================ |
| NATIVE PACKED-Q1 LORA BOOTSTRAP |
| ================================================================================================================ |
| Started UTC: 2026-07-20T22:01:27Z |
| Repository URL: https://github.com/PrismML-Eng/llama.cpp.git |
| Required commit: 7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f |
| Repository directory: /content/Prism-llama.cpp |
| Build directory: /content/Prism-llama.cpp/build |
| Project directory: /content/prism_native_q1_lora |
| Model directory: /content/models/Bonsai-27B-Q1 |
| Build jobs: 2 |
| Python: 3.12.13 (main, Mar 4 2026, 09:23:07) [GCC 11.4.0] |
| Platform: Linux-6.6.122+-x86_64-with-glibc2.35 |
|
|
| ================================================================================================================ |
| APT PACKAGE INDEX |
| ================================================================================================================ |
| COMMAND: |
| 'apt-get' 'update' '-qq' |
|
|
| W: Skipping acquire of configured file 'main/source/Sources' as repository 'https://r2u.stat.illinois.edu/ubuntu jammy InRelease' does not seem to provide it (sources.list entry misspelt?) |
|
|
| RETURN CODE: 0 |
|
|
| ================================================================================================================ |
| INSTALL BUILD DEPENDENCIES |
| ================================================================================================================ |
| COMMAND: |
| 'apt-get' 'install' '-y' '-qq' 'build-essential' 'cmake' 'ninja-build' 'ccache' 'git' 'git-lfs' 'pkg-config' 'libssl-dev' 'libcurl4-openssl-dev' 'python3-dev' |
|
|
| Preconfiguring packages ... |
| (Reading database ... |
| (Reading database ... 5% |
| (Reading database ... 10% |
| (Reading database ... 15% |
| (Reading database ... 20% |
| (Reading database ... 25% |
| (Reading database ... 30% |
| (Reading database ... 35% |
| (Reading database ... 40% |
| (Reading database ... 45% |
| (Reading database ... 50% |
| (Reading database ... 55% |
| (Reading database ... 60% |
| (Reading database ... 65% |
| (Reading database ... 70% |
| (Reading database ... 75% |
| (Reading database ... 80% |
| (Reading database ... 85% |
| (Reading database ... 90% |
| (Reading database ... 95% |
| (Reading database ... 100% |
| (Reading database ... 122403 files and directories currently installed.) |
| Removing r-base-dev (4.6.0-4.2204.0) ... |
| dpkg: pkgconf: dependency problems, but removing anyway as you requested: |
| libsndfile1-dev:amd64 depends on pkg-config; however: |
| Package pkg-config is not installed. |
| Package pkgconf which provides pkg-config is to be removed. |
| libmkl-dev:amd64 depends on pkg-config; however: |
| Package pkg-config is not installed. |
| Package pkgconf which provides pkg-config is to be removed. |
| libglib2.0-dev:amd64 depends on pkg-config; however: |
| Package pkg-config is not installed. |
| Package pkgconf which provides pkg-config is to be removed. |
| libfontconfig-dev:amd64 depends on pkg-config; however: |
| Package pkg-config is not installed. |
| Package pkgconf which provides pkg-config is to be removed. |
|
|
| Removing pkgconf (1.8.0-1) ... |
| Removing 'diversion of /usr/bin/pkg-config to /usr/bin/pkg-config.real by pkgconf' |
| Removing 'diversion of /usr/share/aclocal/pkg.m4 to /usr/share/aclocal/pkg.real.m4 by pkgconf' |
| Removing 'diversion of /usr/share/man/man1/pkg-config.1.gz to /usr/share/man/man1/pkg-config.real.1.gz by pkgconf' |
| Removing 'diversion of /usr/share/pkg-config-crosswrapper to /usr/share/pkg-config-crosswrapper.real by pkgconf' |
| Selecting previously unselected package pkg-config. |
| (Reading database ... |
| (Reading database ... 5% |
| (Reading database ... 10% |
| (Reading database ... 15% |
| (Reading database ... 20% |
| (Reading database ... 25% |
| (Reading database ... 30% |
| (Reading database ... 35% |
| (Reading database ... 40% |
| (Reading database ... 45% |
| (Reading database ... 50% |
| (Reading database ... 55% |
| (Reading database ... 60% |
| (Reading database ... 65% |
| (Reading database ... 70% |
| (Reading database ... 75% |
| (Reading database ... 80% |
| (Reading database ... 85% |
| (Reading database ... 90% |
| (Reading database ... 95% |
| (Reading database ... 100% |
| (Reading database ... 122380 files and directories currently installed.) |
| Preparing to unpack .../pkg-config_0.29.2-1ubuntu3_amd64.deb ... |
| Unpacking pkg-config (0.29.2-1ubuntu3) ... |
| Preparing to unpack .../libpython3.10-dev_3.10.12-1~22.04.16_amd64.deb ... |
| Unpacking libpython3.10-dev:amd64 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ... |
| Preparing to unpack .../libpython3.10_3.10.12-1~22.04.16_amd64.deb ... |
| Unpacking libpython3.10:amd64 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ... |
| Preparing to unpack .../libssl-dev_3.0.2-0ubuntu1.25_amd64.deb ... |
| Unpacking libssl-dev:amd64 (3.0.2-0ubuntu1.25) over (3.0.2-0ubuntu1.23) ... |
| Preparing to unpack .../libssl3_3.0.2-0ubuntu1.25_amd64.deb ... |
| Unpacking libssl3:amd64 (3.0.2-0ubuntu1.25) over (3.0.2-0ubuntu1.23) ... |
| Setting up libssl3:amd64 (3.0.2-0ubuntu1.25) ... |
| (Reading database ... |
| (Reading database ... 5% |
| (Reading database ... 10% |
| (Reading database ... 15% |
| (Reading database ... 20% |
| (Reading database ... 25% |
| (Reading database ... 30% |
| (Reading database ... 35% |
| (Reading database ... 40% |
| (Reading database ... 45% |
| (Reading database ... 50% |
| (Reading database ... 55% |
| (Reading database ... 60% |
| (Reading database ... 65% |
| (Reading database ... 70% |
| (Reading database ... 75% |
| (Reading database ... 80% |
| (Reading database ... 85% |
| (Reading database ... 90% |
| (Reading database ... 95% |
| (Reading database ... 100% |
| (Reading database ... 122395 files and directories currently installed.) |
| Preparing to unpack .../00-python3.10_3.10.12-1~22.04.16_amd64.deb ... |
| Unpacking python3.10 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ... |
| Preparing to unpack .../01-libpython3.10-stdlib_3.10.12-1~22.04.16_amd64.deb ... |
| Unpacking libpython3.10-stdlib:amd64 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ... |
| Preparing to unpack .../02-python3.10-minimal_3.10.12-1~22.04.16_amd64.deb ... |
| Unpacking python3.10-minimal (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ... |
| Preparing to unpack .../03-libpython3.10-minimal_3.10.12-1~22.04.16_amd64.deb ... |
| Unpacking libpython3.10-minimal:amd64 (3.10.12-1~22.04.16) over (3.10.12-1~22.04.15) ... |
| Selecting previously unselected package libhiredis0.14:amd64. |
| Preparing to unpack .../04-libhiredis0.14_0.14.1-2_amd64.deb ... |
| Unpacking libhiredis0.14:amd64 (0.14.1-2) ... |
| Selecting previously unselected package ccache. |
| Preparing to unpack .../05-ccache_4.5.1-1_amd64.deb ... |
| Unpacking ccache (4.5.1-1) ... |
| Preparing to unpack .../06-libcurl4-openssl-dev_7.81.0-1ubuntu1.25_amd64.deb ... |
| Unpacking libcurl4-openssl-dev:amd64 (7.81.0-1ubuntu1.25) over (7.81.0-1ubuntu1.24) ... |
| Preparing to unpack .../07-curl_7.81.0-1ubuntu1.25_amd64.deb ... |
| Unpacking curl (7.81.0-1ubuntu1.25) over (7.81.0-1ubuntu1.24) ... |
| Preparing to unpack .../08-libcurl4_7.81.0-1ubuntu1.25_amd64.deb ... |
| Unpacking libcurl4:amd64 (7.81.0-1ubuntu1.25) over (7.81.0-1ubuntu1.24) ... |
| Selecting previously unselected package git-lfs. |
| Preparing to unpack .../09-git-lfs_3.0.2-1ubuntu0.3_amd64.deb ... |
| Unpacking git-lfs (3.0.2-1ubuntu0.3) ... |
| Selecting previously unselected package javascript-common. |
| Preparing to unpack .../10-javascript-common_11+nmu1_all.deb ... |
| Unpacking javascript-common (11+nmu1) ... |
| Selecting previously unselected package libjs-underscore. |
| Preparing to unpack .../11-libjs-underscore_1.13.2~dfsg-2_all.deb ... |
| Unpacking libjs-underscore (1.13.2~dfsg-2) ... |
| Selecting previously unselected package libjs-sphinxdoc. |
| Preparing to unpack .../12-libjs-sphinxdoc_4.3.2-1_all.deb ... |
| Unpacking libjs-sphinxdoc (4.3.2-1) ... |
| Selecting previously unselected package ninja-build. |
| Preparing to unpack .../13-ninja-build_1.10.1-1_amd64.deb ... |
| Unpacking ninja-build (1.10.1-1) ... |
| Selecting previously unselected package python3.10-dev. |
| Preparing to unpack .../14-python3.10-dev_3.10.12-1~22.04.16_amd64.deb ... |
| Unpacking python3.10-dev (3.10.12-1~22.04.16) ... |
| Selecting previously unselected package python3-dev. |
| Preparing to unpack .../15-python3-dev_3.10.6-1~22.04.1_amd64.deb ... |
| Unpacking python3-dev (3.10.6-1~22.04.1) ... |
| Preparing to unpack .../16-r-base-core_4.6.1-1.2204.1_amd64.deb ... |
| Unpacking r-base-core (4.6.1-1.2204.1) over (4.6.0-4.2204.0) ... |
| Setting up javascript-common (11+nmu1) ... |
| Setting up ninja-build (1.10.1-1) ... |
| Setting up libssl-dev:amd64 (3.0.2-0ubuntu1.25) ... |
| Setting up libpython3.10-minimal:amd64 (3.10.12-1~22.04.16) ... |
| Setting up pkg-config (0.29.2-1ubuntu3) ... |
| Setting up libcurl4:amd64 (7.81.0-1ubuntu1.25) ... |
| Setting up curl (7.81.0-1ubuntu1.25) ... |
| Setting up git-lfs (3.0.2-1ubuntu0.3) ... |
| Setting up libjs-underscore (1.13.2~dfsg-2) ... |
| Setting up libhiredis0.14:amd64 (0.14.1-2) ... |
| Setting up ccache (4.5.1-1) ... |
| Updating symlinks in /usr/lib/ccache ... |
| Setting up python3.10-minimal (3.10.12-1~22.04.16) ... |
| Setting up libpython3.10-stdlib:amd64 (3.10.12-1~22.04.16) ... |
| Setting up libcurl4-openssl-dev:amd64 (7.81.0-1ubuntu1.25) ... |
| Setting up r-base-core (4.6.1-1.2204.1) ... |
| Installing new version of config file /etc/R/Makeconf ... |
| Setting up libjs-sphinxdoc (4.3.2-1) ... |
| Setting up libpython3.10:amd64 (3.10.12-1~22.04.16) ... |
| Setting up python3.10 (3.10.12-1~22.04.16) ... |
| Setting up libpython3.10-dev:amd64 (3.10.12-1~22.04.16) ... |
| Setting up python3.10-dev (3.10.12-1~22.04.16) ... |
| Setting up python3-dev (3.10.6-1~22.04.1) ... |
| Processing triggers for hicolor-icon-theme (0.17-2) ... |
| Processing triggers for libc-bin (2.35-0ubuntu3.8) ... |
| /sbin/ldconfig.real: /usr/local/lib/libumf.so.1 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libtbbmalloc.so.2 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libur_adapter_level_zero_v2.so.0 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libtbbbind_2_5.so.3 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libur_adapter_level_zero.so.0 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libur_adapter_opencl.so.0 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libtbbmalloc_proxy.so.2 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libur_loader.so.0 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libtbbbind.so.3 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libtcm_debug.so.1 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libhwloc.so.15 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libtbb.so.12 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libtbbbind_2_0.so.3 is not a symbolic link |
|
|
| /sbin/ldconfig.real: /usr/local/lib/libtcm.so.1 is not a symbolic link |
|
|
| Processing triggers for man-db (2.10.2-1) ... |
| Processing triggers for mailcap (3.70+nmu1ubuntu1) ... |
|
|
| RETURN CODE: 0 |
|
|
| ================================================================================================================ |
| INSTALL PYTHON DOWNLOAD DEPENDENCIES |
| ================================================================================================================ |
| COMMAND: |
| '/usr/bin/python3' '-m' 'pip' 'install' '-q' '--upgrade' 'huggingface_hub' 'hf_transfer' 'safetensors' |
|
|
| ━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━ 771.9/771.9 kB 46.1 MB/s eta 0:00:00 |
| ━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━ 3.6/3.6 MB 125.4 MB/s eta 0:00:00 |
|
|
| RETURN CODE: 0 |
|
|
| ================================================================================================================ |
| CUDA ENVIRONMENT |
| ================================================================================================================ |
| PyTorch version: 2.11.0+cu128 |
| PyTorch CUDA version: 12.8 |
| CUDA device index: 0 |
| CUDA device name: NVIDIA L4 |
| CUDA compute capability: 8.9 |
| CMake CUDA architecture: 89 |
| Total VRAM: 22.034 GiB |
|
|
| NVIDIA-SMI: |
| Mon Jul 20 22:02:07 2026 |
| +-----------------------------------------------------------------------------------------+ |
| | NVIDIA-SMI 580.82.07 Driver Version: 580.82.07 CUDA Version: 13.0 | |
| +-----------------------------------------+------------------------+----------------------+ |
| | GPU Name Persistence-M | Bus-Id Disp.A | Volatile Uncorr. ECC | |
| | Fan Temp Perf Pwr:Usage/Cap | Memory-Usage | GPU-Util Compute M. | |
| | | | MIG M. | |
| |=========================================+========================+======================| |
| | 0 NVIDIA L4 Off | 00000000:00:03.0 Off | 0 | |
| | N/A 36C P8 14W / 72W | 3MiB / 23034MiB | 0% Default | |
| | | | N/A | |
| +-----------------------------------------+------------------------+----------------------+ |
|
|
| +-----------------------------------------------------------------------------------------+ |
| | Processes: | |
| | GPU GI CI PID Type Process name GPU Memory | |
| | ID ID Usage | |
| |=========================================================================================| |
| | No running processes found | |
| +-----------------------------------------------------------------------------------------+ |
| NVIDIA-SMI return code: 0 |
|
|
| NVCC: |
| nvcc: NVIDIA (R) Cuda compiler driver |
| Copyright (c) 2005-2025 NVIDIA Corporation |
| Built on Fri_Feb_21_20:23:50_PST_2025 |
| Cuda compilation tools, release 12.8, V12.8.93 |
| Build cuda_12.8.r12.8/compiler.35583870_0 |
| NVCC return code: 0 |
|
|
| ================================================================================================================ |
| CONFIGURE CCACHE |
| ================================================================================================================ |
| COMMAND: |
| 'ccache' '--max-size' '10G' |
|
|
| Set cache size limit to 10.0 GB |
|
|
| RETURN CODE: 0 |
|
|
| ================================================================================================================ |
| INITIALIZE PRISM REPOSITORY |
| ================================================================================================================ |
| COMMAND: |
| 'git' 'init' '/content/Prism-llama.cpp' |
|
|
| hint: Using 'master' as the name for the initial branch. This default branch name |
| hint: is subject to change. To configure the initial branch name to use in all |
| hint: of your new repositories, which will suppress this warning, call: |
| hint: |
| hint: git config --global init.defaultBranch <name> |
| hint: |
| hint: Names commonly chosen instead of 'master' are 'main', 'trunk' and |
| hint: 'development'. The just-created branch can be renamed via this command: |
| hint: |
| hint: git branch -m <name> |
| Initialized empty Git repository in /content/Prism-llama.cpp/.git/ |
|
|
| RETURN CODE: 0 |
|
|
| ================================================================================================================ |
| ADD PRISM REMOTE |
| ================================================================================================================ |
| COMMAND: |
| 'git' '-C' '/content/Prism-llama.cpp' 'remote' 'add' 'origin' 'https://github.com/PrismML-Eng/llama.cpp.git' |
|
|
|
|
|
|
| RETURN CODE: 0 |
|
|
| ================================================================================================================ |
| FETCH EXACT PRISM COMMIT |
| ================================================================================================================ |
| COMMAND: |
| 'git' '-C' '/content/Prism-llama.cpp' 'fetch' '--depth' '1' 'origin' '7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f' |
|
|
| From https://github.com/PrismML-Eng/llama.cpp |
| * branch 7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f -> FETCH_HEAD |
|
|
| RETURN CODE: 0 |
|
|
| ================================================================================================================ |
| CHECK OUT EXACT PRISM COMMIT |
| ================================================================================================================ |
| COMMAND: |
| 'git' '-C' '/content/Prism-llama.cpp' 'checkout' '--detach' 'FETCH_HEAD' |
|
|
| HEAD is now at 7529fda force qwen35 to treat IGPU like a GPU so DSpark does not fall back to CPU (#88) |
|
|
| RETURN CODE: 0 |
|
|
| ================================================================================================================ |
| SOURCE CHECKOUT |
| ================================================================================================================ |
| Resolved commit: 7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f |
| Detached checkout: True |
| Working tree clean: True |
|
|
| Commit information: |
| commit 7529fdaaf99ffdc5ca71ace9c7409a56b27ad92f |
| Author: Thad Reber <thad.reber@gmail.com> |
| AuthorDate: Sun Jul 19 23:50:54 2026 -0700 |
| Commit: GitHub <noreply@github.com> |
| CommitDate: Sun Jul 19 23:50:54 2026 -0700 |
|
|
| force qwen35 to treat IGPU like a GPU so DSpark does not fall back to CPU (#88) |
|
|
| ================================================================================================================ |
| CMAKE CONFIGURATION |
| ================================================================================================================ |
| COMMAND: |
| 'cmake' '-S' '/content/Prism-llama.cpp' '-B' '/content/Prism-llama.cpp/build' '-G' 'Ninja' '-DCMAKE_BUILD_TYPE=Release' '-DGGML_CUDA=ON' '-DCMAKE_CUDA_ARCHITECTURES=89' '-DLLAMA_BUILD_COMMON=ON' '-DLLAMA_BUILD_EXAMPLES=ON' '-DLLAMA_BUILD_TOOLS=ON' '-DLLAMA_BUILD_SERVER=ON' '-DLLAMA_BUILD_TESTS=ON' '-DBUILD_TESTING=ON' '-DLLAMA_BUILD_UI=OFF' '-DLLAMA_FATAL_WARNINGS=OFF' '-DGGML_CCACHE=ON' '-DLLAMA_OPENSSL=ON' |
|
|
| -- The C compiler identification is GNU 11.4.0 |
| -- The CXX compiler identification is GNU 11.4.0 |
| -- Detecting C compiler ABI info |
| -- Detecting C compiler ABI info - done |
| -- Check for working C compiler: /usr/bin/cc - skipped |
| -- Detecting C compile features |
| -- Detecting C compile features - done |
| -- Detecting CXX compiler ABI info |
| -- Detecting CXX compiler ABI info - done |
| -- Check for working CXX compiler: /usr/bin/c++ - skipped |
| -- Detecting CXX compile features |
| -- Detecting CXX compile features - done |
| CMAKE_BUILD_TYPE=Release |
| -- Found Git: /usr/bin/git (found version "2.34.1") |
| -- The ASM compiler identification is GNU |
| -- Found assembler: /usr/bin/cc |
| -- Performing Test CMAKE_HAVE_LIBC_PTHREAD |
| -- Performing Test CMAKE_HAVE_LIBC_PTHREAD - Success |
| -- Found Threads: TRUE |
| -- ccache found, compilation results will be cached. Disable with GGML_CCACHE=OFF. |
| -- CMAKE_SYSTEM_PROCESSOR: x86_64 |
| -- GGML_SYSTEM_ARCH: x86 |
| -- Found OpenMP_C: -fopenmp (found version "4.5") |
| -- Found OpenMP_CXX: -fopenmp (found version "4.5") |
| -- Found OpenMP: TRUE (found version "4.5") |
| -- Including CPU backend |
| -- x86 detected |
| -- Adding CPU backend variant ggml-cpu: -march=native |
| -- Found CUDAToolkit: /usr/local/cuda/targets/x86_64-linux/include (found version "12.8.93") |
| -- CUDA Toolkit found |
| -- The CUDA compiler identification is NVIDIA 12.8.93 with host compiler GNU 11.4.0 |
| -- Detecting CUDA compiler ABI info |
| -- Detecting CUDA compiler ABI info - done |
| -- Check for working CUDA compiler: /usr/local/cuda/bin/nvcc - skipped |
| -- Detecting CUDA compile features |
| -- Detecting CUDA compile features - done |
| -- Using CMAKE_CUDA_ARCHITECTURES=89 CMAKE_CUDA_ARCHITECTURES_NATIVE=89-real |
| -- Found NCCL: /usr/lib/x86_64-linux-gnu/libnccl.so |
| -- CUDA host compiler is GNU 11.4.0 |
| -- Including CUDA backend |
| -- ggml version: 0.13.1 |
| -- ggml commit: 7529fda |
| -- Found OpenSSL: /usr/lib/x86_64-linux-gnu/libcrypto.so (found version "3.0.2") |
| -- Performing Test OPENSSL_VERSION_SUPPORTED |
| -- Performing Test OPENSSL_VERSION_SUPPORTED - Success |
| -- OpenSSL found: 3.0.2 |
| -- Generating embedded license file for target: llama-app |
| -- Configuring done (5.2s) |
| -- Generating done (0.2s) |
| -- Build files have been written to: /content/Prism-llama.cpp/build |
|
|
| RETURN CODE: 0 |
|
|
| ================================================================================================================ |
| REQUIRED BUILD TARGETS |
| ================================================================================================================ |
| [FOUND] llama-cli |
| [FOUND] llama-completion |
| [FOUND] llama-server |
| [FOUND] llama-finetune |
| [FOUND] llama-export-lora |
| [FOUND] test-backend-ops |
|
|
| ================================================================================================================ |
| BUILD PRISM CUDA TARGETS |
| ================================================================================================================ |
| COMMAND: |
| 'cmake' '--build' '/content/Prism-llama.cpp/build' '--parallel' '2' '--target' 'llama-cli' 'llama-completion' 'llama-server' 'llama-finetune' 'llama-export-lora' 'test-backend-ops' |
|
|
| [1/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml.cpp.o |
| [2/451] Building C object ggml/src/CMakeFiles/ggml-base.dir/ggml-alloc.c.o |
| [3/451] Building C object ggml/src/CMakeFiles/ggml-base.dir/ggml.c.o |
| [4/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml-backend.cpp.o |
| [5/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml-opt.cpp.o |
| [6/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml-threading.cpp.o |
| [7/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/ggml-backend-meta.cpp.o |
| [8/451] Building CXX object ggml/src/CMakeFiles/ggml-base.dir/gguf.cpp.o |
| [9/451] Building C object ggml/src/CMakeFiles/ggml-base.dir/ggml-quants.c.o |
| [10/451] Linking CXX shared library bin/libggml-base.so.0.13.1 |
| [11/451] Creating library symlink bin/libggml-base.so.0 bin/libggml-base.so |
| [12/451] Building CXX object ggml/src/CMakeFiles/ggml.dir/ggml-backend-dl.cpp.o |
| [13/451] Building CXX object ggml/src/CMakeFiles/ggml.dir/ggml-backend-reg.cpp.o |
| [14/451] Building C object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/ggml-cpu.c.o |
| [15/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/ggml-cpu.cpp.o |
| [16/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/hbm.cpp.o |
| [17/451] Building C object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/quants.c.o |
| [18/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/traits.cpp.o |
| [19/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/amx/amx.cpp.o |
| [20/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/amx/mmq.cpp.o |
| [21/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/repack.cpp.o |
| [22/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/binary-ops.cpp.o |
| [23/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/vec.cpp.o |
| [24/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/unary-ops.cpp.o |
| [25/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/llamafile/sgemm.cpp.o |
| [26/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/ops.cpp.o |
| [27/451] Building C object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/arch/x86/quants.c.o |
| [28/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/acc.cu.o |
| [29/451] Building CXX object ggml/src/CMakeFiles/ggml-cpu.dir/ggml-cpu/arch/x86/repack.cpp.o |
| [30/451] Linking CXX shared library bin/libggml-cpu.so.0.13.1 |
| [31/451] Creating library symlink bin/libggml-cpu.so.0 bin/libggml-cpu.so |
| [32/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/add-id.cu.o |
| [33/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/allreduce.cu.o |
| [34/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/arange.cu.o |
| [35/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/argmax.cu.o |
| [36/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/binbcast.cu.o |
| [37/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/clamp.cu.o |
| [38/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/concat.cu.o |
| [39/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/conv-transpose-1d.cu.o |
| [40/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/conv2d-dw.cu.o |
| [41/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/argsort.cu.o |
| [42/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/conv2d-transpose.cu.o |
| [43/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/conv2d.cu.o |
| [44/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/convert.cu.o |
| [45/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/count-equal.cu.o |
| [46/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/cross-entropy-loss.cu.o |
| [47/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/cpy.cu.o |
| [48/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/diag.cu.o |
| [49/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/cumsum.cu.o |
| [50/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/diagmask.cu.o |
| [51/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fattn-tile.cu.o |
| [52/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fattn-wmma-f16.cu.o |
| [53/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fill.cu.o |
| [54/451] Building CXX object src/CMakeFiles/llama.dir/llama-memory.cpp.o |
| [55/451] Building CXX object src/CMakeFiles/llama.dir/llama-memory-hybrid.cpp.o |
| [56/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fwht.cu.o |
| [57/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/gated_delta_net.cu.o |
| [58/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/fattn.cu.o |
| [59/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/getrows.cu.o |
| [60/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/ggml-cuda.cu.o |
| [61/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/gla.cu.o |
| [62/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/im2col.cu.o |
| [63/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmf.cu.o |
| [64/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mean.cu.o |
| [65/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmid.cu.o |
| [66/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmq-hopper-q1.cu.o |
| [67/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmvf.cu.o |
| [68/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmq.cu.o |
| [69/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/norm.cu.o |
| [70/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/opt-step-adamw.cu.o |
| [71/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/opt-step-sgd.cu.o |
| [72/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/out-prod.cu.o |
| [73/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/pad.cu.o |
| [74/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/pad_reflect_1d.cu.o |
| [75/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/pool2d.cu.o |
| [76/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/mmvq.cu.o |
| [77/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/quantize.cu.o |
| [78/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/roll.cu.o |
| [79/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/scale.cu.o |
| [80/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/rope.cu.o |
| [81/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/set.cu.o |
| [82/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/set-rows.cu.o |
| [83/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/snake.cu.o |
| [84/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/softcap.cu.o |
| [85/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/softmax.cu.o |
| [86/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/solve_tri.cu.o |
| [87/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/ssm-conv.cu.o |
| [88/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/ssm-scan.cu.o |
| [89/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/sum.cu.o |
| [90/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/sumrows.cu.o |
| [91/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/top-k.cu.o |
| [92/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/topk-moe.cu.o |
| [93/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/tri.cu.o |
| [94/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/tsembd.cu.o |
| [95/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/upscale.cu.o |
| [96/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/unary.cu.o |
| [97/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/wkv.cu.o |
| [98/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq112-dv112.cu.o |
| [99/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq192-dv128.cu.o |
| [100/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq128-dv128.cu.o |
| [101/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq320-dv256.cu.o |
| [102/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq40-dv40.cu.o |
| [103/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq512-dv512.cu.o |
| [104/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq256-dv256.cu.o |
| [105/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq576-dv512.cu.o |
| [106/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq64-dv64.cu.o |
| [107/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq72-dv72.cu.o |
| [108/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq80-dv80.cu.o |
| [109/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_1-ncols2_16.cu.o |
| [110/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-tile-instance-dkq96-dv96.cu.o |
| [111/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_1-ncols2_32.cu.o |
| [112/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_1-ncols2_8.cu.o |
| [113/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_16-ncols2_1.cu.o |
| [114/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_16-ncols2_2.cu.o |
| [115/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_2-ncols2_16.cu.o |
| [116/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_2-ncols2_32.cu.o |
| [117/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_16-ncols2_4.cu.o |
| [118/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_2-ncols2_4.cu.o |
| [119/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_2-ncols2_8.cu.o |
| [120/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_32-ncols2_2.cu.o |
| [121/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_32-ncols2_1.cu.o |
| [122/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_4-ncols2_16.cu.o |
| [123/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_4-ncols2_2.cu.o |
| [124/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_4-ncols2_4.cu.o |
| [125/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_4-ncols2_8.cu.o |
| [126/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_64-ncols2_1.cu.o |
| [127/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_8-ncols2_1.cu.o |
| [128/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_8-ncols2_2.cu.o |
| [129/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_8-ncols2_4.cu.o |
| [130/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-mma-f16-instance-ncols1_8-ncols2_8.cu.o |
| [131/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq1_s.cu.o |
| [132/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq2_s.cu.o |
| [133/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq2_xs.cu.o |
| [134/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq2_xxs.cu.o |
| [135/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq3_s.cu.o |
| [136/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq3_xxs.cu.o |
| [137/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq4_nl.cu.o |
| [138/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-iq4_xs.cu.o |
| [139/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-mxfp4.cu.o |
| [140/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-nvfp4.cu.o |
| [141/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q1_0.cu.o |
| [142/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q2_0.cu.o |
| [143/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q2_k.cu.o |
| [144/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q3_k.cu.o |
| [145/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/caps.cpp.o |
| [146/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q4_0.cu.o |
| [147/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q4_1.cu.o |
| [148/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q4_k.cu.o |
| [149/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q5_0.cu.o |
| [150/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q5_1.cu.o |
| [151/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q5_k.cu.o |
| [152/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q8_0.cu.o |
| [153/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmq-instance-q6_k.cu.o |
| [154/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_1.cu.o |
| [155/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_10.cu.o |
| [156/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_11.cu.o |
| [157/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_12.cu.o |
| [158/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_13.cu.o |
| [159/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_14.cu.o |
| [160/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_15.cu.o |
| [161/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_16.cu.o |
| [162/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_2.cu.o |
| [163/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_3.cu.o |
| [164/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_4.cu.o |
| [165/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_5.cu.o |
| [166/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_6.cu.o |
| [167/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_7.cu.o |
| [168/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_8.cu.o |
| [169/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/mmf-instance-ncols_9.cu.o |
| [170/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-vec-instance-f16-f16.cu.o |
| [171/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-vec-instance-q4_0-q4_0.cu.o |
| [172/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-vec-instance-q8_0-q8_0.cu.o |
| [173/451] Building CXX object src/CMakeFiles/llama.dir/llama.cpp.o |
| [174/451] Building CXX object src/CMakeFiles/llama.dir/llama-adapter.cpp.o |
| [175/451] Building CXX object src/CMakeFiles/llama.dir/llama-arch.cpp.o |
| [176/451] Building CXX object src/CMakeFiles/llama.dir/llama-batch.cpp.o |
| [177/451] Building CXX object src/CMakeFiles/llama.dir/llama-chat.cpp.o |
| [178/451] Building CUDA object ggml/src/ggml-cuda/CMakeFiles/ggml-cuda.dir/template-instances/fattn-vec-instance-bf16-bf16.cu.o |
| [179/451] Linking CUDA shared library bin/libggml-cuda.so.0.13.1 |
| [180/451] Creating library symlink bin/libggml-cuda.so.0 bin/libggml-cuda.so |
| [181/451] Linking CXX shared library bin/libggml.so.0.13.1 |
| [182/451] Creating library symlink bin/libggml.so.0 bin/libggml.so |
| [183/451] Building CXX object src/CMakeFiles/llama.dir/llama-cparams.cpp.o |
| [184/451] Building CXX object src/CMakeFiles/llama.dir/llama-context.cpp.o |
| [185/451] Building CXX object src/CMakeFiles/llama.dir/llama-graph.cpp.o |
| [186/451] Building CXX object src/CMakeFiles/llama.dir/llama-hparams.cpp.o |
| [187/451] Building CXX object src/CMakeFiles/llama.dir/llama-impl.cpp.o |
| [188/451] Building CXX object src/CMakeFiles/llama.dir/llama-io.cpp.o |
| [189/451] Building CXX object src/CMakeFiles/llama.dir/llama-grammar.cpp.o |
| [190/451] Building CXX object src/CMakeFiles/llama.dir/llama-kv-cache-iswa.cpp.o |
| [191/451] Building CXX object src/CMakeFiles/llama.dir/llama-kv-cache-dsa.cpp.o |
| [192/451] Building CXX object src/CMakeFiles/llama.dir/llama-memory-hybrid-iswa.cpp.o |
| [193/451] Building CXX object src/CMakeFiles/llama.dir/llama-kv-cache.cpp.o |
| [194/451] Building CXX object src/CMakeFiles/llama.dir/llama-mmap.cpp.o |
| [195/451] Building CXX object src/CMakeFiles/llama.dir/llama-memory-recurrent.cpp.o |
| [196/451] Building CXX object src/CMakeFiles/llama.dir/llama-model-saver.cpp.o |
| [197/451] Building CXX object src/CMakeFiles/llama.dir/llama-model-loader.cpp.o |
| [198/451] Building CXX object src/CMakeFiles/llama.dir/llama-model.cpp.o |
| [199/451] Building CXX object src/CMakeFiles/llama.dir/llama-quant.cpp.o |
| [200/451] Building CXX object src/CMakeFiles/llama.dir/llama-sampler.cpp.o |
| [201/451] Building CXX object src/CMakeFiles/llama.dir/unicode-data.cpp.o |
| [202/451] Building CXX object src/CMakeFiles/llama.dir/llama-vocab.cpp.o |
| [203/451] Building CXX object src/CMakeFiles/llama.dir/models/afmoe.cpp.o |
| [204/451] Building CXX object src/CMakeFiles/llama.dir/models/apertus.cpp.o |
| [205/451] Building CXX object src/CMakeFiles/llama.dir/models/arcee.cpp.o |
| [206/451] Building CXX object src/CMakeFiles/llama.dir/models/arctic.cpp.o |
| [207/451] Building CXX object src/CMakeFiles/llama.dir/models/arwkv7.cpp.o |
| [208/451] Building CXX object src/CMakeFiles/llama.dir/models/baichuan.cpp.o |
| [209/451] Building CXX object src/CMakeFiles/llama.dir/unicode.cpp.o |
| [210/451] Building CXX object src/CMakeFiles/llama.dir/models/bailingmoe.cpp.o |
| [211/451] Building CXX object src/CMakeFiles/llama.dir/models/bailingmoe2.cpp.o |
| [212/451] Building CXX object src/CMakeFiles/llama.dir/models/bert.cpp.o |
| [213/451] Building CXX object src/CMakeFiles/llama.dir/models/bitnet.cpp.o |
| [214/451] Building CXX object src/CMakeFiles/llama.dir/models/bloom.cpp.o |
| [215/451] Building CXX object src/CMakeFiles/llama.dir/models/chameleon.cpp.o |
| [216/451] Building CXX object src/CMakeFiles/llama.dir/models/chatglm.cpp.o |
| [217/451] Building CXX object src/CMakeFiles/llama.dir/models/codeshell.cpp.o |
| [218/451] Building CXX object src/CMakeFiles/llama.dir/models/cogvlm.cpp.o |
| [219/451] Building CXX object src/CMakeFiles/llama.dir/models/cohere2.cpp.o |
| [220/451] Building CXX object src/CMakeFiles/llama.dir/models/command-r.cpp.o |
| [221/451] Building CXX object src/CMakeFiles/llama.dir/models/dbrx.cpp.o |
| [222/451] Building CXX object src/CMakeFiles/llama.dir/models/deci.cpp.o |
| [223/451] Building CXX object src/CMakeFiles/llama.dir/models/deepseek.cpp.o |
| [224/451] Building CXX object src/CMakeFiles/llama.dir/models/deepseek2.cpp.o |
| [225/451] Building CXX object src/CMakeFiles/llama.dir/models/deepseek2ocr.cpp.o |
| [226/451] Building CXX object src/CMakeFiles/llama.dir/models/deepseek32.cpp.o |
| [227/451] Building CXX object src/CMakeFiles/llama.dir/models/delta-net-base.cpp.o |
| [228/451] Building CXX object src/CMakeFiles/llama.dir/models/dots1.cpp.o |
| [229/451] Building CXX object src/CMakeFiles/llama.dir/models/dream.cpp.o |
| [230/451] Building CXX object src/CMakeFiles/llama.dir/models/dspark.cpp.o |
| [231/451] Building CXX object src/CMakeFiles/llama.dir/models/ernie4-5-moe.cpp.o |
| [232/451] Building CXX object src/CMakeFiles/llama.dir/models/ernie4-5.cpp.o |
| [233/451] Building CXX object src/CMakeFiles/llama.dir/models/eurobert.cpp.o |
| [234/451] Building CXX object src/CMakeFiles/llama.dir/models/exaone-moe.cpp.o |
| [235/451] Building CXX object src/CMakeFiles/llama.dir/models/exaone.cpp.o |
| [236/451] Building CXX object src/CMakeFiles/llama.dir/models/exaone4.cpp.o |
| [237/451] Building CXX object src/CMakeFiles/llama.dir/models/falcon-h1.cpp.o |
| [238/451] Building CXX object src/CMakeFiles/llama.dir/models/falcon.cpp.o |
| [239/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma-embedding.cpp.o |
| [240/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma.cpp.o |
| [241/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma2.cpp.o |
| [242/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma3.cpp.o |
| [243/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma3n.cpp.o |
| [244/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma4-assistant.cpp.o |
| [245/451] Building CXX object src/CMakeFiles/llama.dir/models/gemma4.cpp.o |
| [246/451] Building CXX object src/CMakeFiles/llama.dir/models/glm-dsa.cpp.o |
| [247/451] Building CXX object src/CMakeFiles/llama.dir/models/glm4-moe.cpp.o |
| [248/451] Building CXX object src/CMakeFiles/llama.dir/models/glm4.cpp.o |
| [249/451] Building CXX object src/CMakeFiles/llama.dir/models/gpt2.cpp.o |
| [250/451] Building CXX object src/CMakeFiles/llama.dir/models/gptneox.cpp.o |
| [251/451] Building CXX object src/CMakeFiles/llama.dir/models/granite-hybrid.cpp.o |
| [252/451] Building CXX object src/CMakeFiles/llama.dir/models/granite-moe.cpp.o |
| [253/451] Building CXX object src/CMakeFiles/llama.dir/models/granite.cpp.o |
| [254/451] Building CXX object src/CMakeFiles/llama.dir/models/grok.cpp.o |
| [255/451] Building CXX object src/CMakeFiles/llama.dir/models/grovemoe.cpp.o |
| [256/451] Building CXX object src/CMakeFiles/llama.dir/models/hunyuan-dense.cpp.o |
| [257/451] Building CXX object src/CMakeFiles/llama.dir/models/hunyuan-moe.cpp.o |
| [258/451] Building CXX object src/CMakeFiles/llama.dir/models/hunyuan-vl.cpp.o |
| [259/451] Building CXX object src/CMakeFiles/llama.dir/models/internlm2.cpp.o |
| [260/451] Building CXX object src/CMakeFiles/llama.dir/models/jais.cpp.o |
| [261/451] Building CXX object src/CMakeFiles/llama.dir/models/jais2.cpp.o |
| [262/451] Building CXX object src/CMakeFiles/llama.dir/models/jamba.cpp.o |
| [263/451] Building CXX object src/CMakeFiles/llama.dir/models/jina-bert-v2.cpp.o |
| [264/451] Building CXX object src/CMakeFiles/llama.dir/models/jina-bert-v3.cpp.o |
| [265/451] Building CXX object src/CMakeFiles/llama.dir/models/kimi-linear.cpp.o |
| [266/451] Building CXX object src/CMakeFiles/llama.dir/models/lfm2.cpp.o |
| [267/451] Building CXX object src/CMakeFiles/llama.dir/models/lfm2moe.cpp.o |
| [268/451] Building CXX object src/CMakeFiles/llama.dir/models/llada-moe.cpp.o |
| [269/451] Building CXX object src/CMakeFiles/llama.dir/models/llada.cpp.o |
| [270/451] Building CXX object src/CMakeFiles/llama.dir/models/llama-embed.cpp.o |
| [271/451] Building CXX object src/CMakeFiles/llama.dir/models/llama.cpp.o |
| [272/451] Building CXX object src/CMakeFiles/llama.dir/models/llama4.cpp.o |
| [273/451] Building CXX object src/CMakeFiles/llama.dir/models/maincoder.cpp.o |
| [274/451] Building CXX object src/CMakeFiles/llama.dir/models/mamba-base.cpp.o |
| [275/451] Building CXX object src/CMakeFiles/llama.dir/models/mamba.cpp.o |
| [276/451] Building CXX object src/CMakeFiles/llama.dir/models/mamba2.cpp.o |
| [277/451] Building CXX object src/CMakeFiles/llama.dir/models/mellum.cpp.o |
| [278/451] Building CXX object src/CMakeFiles/llama.dir/models/mimo2.cpp.o |
| [279/451] Building CXX object src/CMakeFiles/llama.dir/models/minicpm.cpp.o |
| [280/451] Building CXX object src/CMakeFiles/llama.dir/models/minicpm3.cpp.o |
| [281/451] Building CXX object src/CMakeFiles/llama.dir/models/minimax-m2.cpp.o |
| [282/451] Building CXX object src/CMakeFiles/llama.dir/models/mistral3.cpp.o |
| [283/451] Building CXX object src/CMakeFiles/llama.dir/models/mistral4.cpp.o |
| [284/451] Building CXX object src/CMakeFiles/llama.dir/models/modern-bert.cpp.o |
| [285/451] Building CXX object src/CMakeFiles/llama.dir/models/mpt.cpp.o |
| [286/451] Building CXX object src/CMakeFiles/llama.dir/models/nemotron-h-moe.cpp.o |
| [287/451] Building CXX object src/CMakeFiles/llama.dir/models/nemotron-h.cpp.o |
| [288/451] Building CXX object src/CMakeFiles/llama.dir/models/nemotron.cpp.o |
| [289/451] Building CXX object src/CMakeFiles/llama.dir/models/neo-bert.cpp.o |
| [290/451] Building CXX object src/CMakeFiles/llama.dir/models/nomic-bert-moe.cpp.o |
| [291/451] Building CXX object src/CMakeFiles/llama.dir/models/nomic-bert.cpp.o |
| [292/451] Building CXX object src/CMakeFiles/llama.dir/models/olmo.cpp.o |
| [293/451] Building CXX object src/CMakeFiles/llama.dir/models/olmo2.cpp.o |
| [294/451] Building CXX object src/CMakeFiles/llama.dir/models/olmoe.cpp.o |
| [295/451] Building CXX object src/CMakeFiles/llama.dir/models/openai-moe.cpp.o |
| [296/451] Building CXX object src/CMakeFiles/llama.dir/models/openelm.cpp.o |
| [297/451] Building CXX object src/CMakeFiles/llama.dir/models/paddleocr.cpp.o |
| [298/451] Building CXX object src/CMakeFiles/llama.dir/models/orion.cpp.o |
| [299/451] Building CXX object src/CMakeFiles/llama.dir/models/pangu-embed.cpp.o |
| [300/451] Building CXX object src/CMakeFiles/llama.dir/models/phi2.cpp.o |
| [301/451] Building CXX object src/CMakeFiles/llama.dir/models/phimoe.cpp.o |
| [302/451] Building CXX object src/CMakeFiles/llama.dir/models/phi3.cpp.o |
| [303/451] Building CXX object src/CMakeFiles/llama.dir/models/plamo.cpp.o |
| [304/451] Building CXX object src/CMakeFiles/llama.dir/models/plamo2.cpp.o |
| [305/451] Building CXX object src/CMakeFiles/llama.dir/models/plamo3.cpp.o |
| [306/451] Building CXX object src/CMakeFiles/llama.dir/models/plm.cpp.o |
| [307/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen.cpp.o |
| [308/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen2.cpp.o |
| [309/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen2moe.cpp.o |
| [310/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen2vl.cpp.o |
| [311/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3.cpp.o |
| [312/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen35.cpp.o |
| [313/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen35moe.cpp.o |
| [314/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3moe.cpp.o |
| [315/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3next.cpp.o |
| [316/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3vl.cpp.o |
| [317/451] Building CXX object src/CMakeFiles/llama.dir/models/qwen3vlmoe.cpp.o |
| [318/451] Building CXX object src/CMakeFiles/llama.dir/models/refact.cpp.o |
| [319/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv6-base.cpp.o |
| [320/451] Building CXX object src/CMakeFiles/llama.dir/models/rnd1.cpp.o |
| [321/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv6qwen2.cpp.o |
| [322/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv6.cpp.o |
| [323/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv7-base.cpp.o |
| [324/451] Building CXX object src/CMakeFiles/llama.dir/models/rwkv7.cpp.o |
| [325/451] Building CXX object src/CMakeFiles/llama.dir/models/seed-oss.cpp.o |
| [326/451] Building CXX object src/CMakeFiles/llama.dir/models/smallthinker.cpp.o |
| [327/451] Building CXX object src/CMakeFiles/llama.dir/models/smollm3.cpp.o |
| [328/451] Building CXX object src/CMakeFiles/llama.dir/models/stablelm.cpp.o |
| [329/451] Building CXX object src/CMakeFiles/llama.dir/models/starcoder.cpp.o |
| [330/451] Building CXX object src/CMakeFiles/llama.dir/models/starcoder2.cpp.o |
| [331/451] Building CXX object src/CMakeFiles/llama.dir/models/step35.cpp.o |
| [332/451] Building CXX object src/CMakeFiles/llama.dir/models/t5.cpp.o |
| [333/451] Building CXX object src/CMakeFiles/llama.dir/models/t5encoder.cpp.o |
| [334/451] Building CXX object src/CMakeFiles/llama.dir/models/talkie.cpp.o |
| [335/451] Building CXX object src/CMakeFiles/llama.dir/models/wavtokenizer-dec.cpp.o |
| [336/451] Building CXX object src/CMakeFiles/llama.dir/models/xverse.cpp.o |
| [337/451] Building CXX object common/CMakeFiles/llama-common-base.dir/build-info.cpp.o |
| [338/451] Linking CXX static library common/libllama-common-base.a |
| [339/451] Linking CXX shared library bin/libllama.so.0.0.1 |
| [340/451] Creating library symlink bin/libllama.so.0 bin/libllama.so |
| [341/451] Building CXX object common/CMakeFiles/llama-common.dir/chat-auto-parser-generator.cpp.o |
| [342/451] Building CXX object common/CMakeFiles/llama-common.dir/chat-auto-parser-helpers.cpp.o |
| [343/451] Building CXX object common/CMakeFiles/llama-common.dir/arg.cpp.o |
| [344/451] Building CXX object common/CMakeFiles/llama-common.dir/chat-diff-analyzer.cpp.o |
| [345/451] Building CXX object common/CMakeFiles/llama-common.dir/chat-peg-parser.cpp.o |
| [346/451] Building CXX object common/CMakeFiles/llama-common.dir/common.cpp.o |
| [347/451] Building CXX object common/CMakeFiles/llama-common.dir/console.cpp.o |
| [348/451] Building CXX object common/CMakeFiles/llama-common.dir/chat.cpp.o |
| [349/451] Building CXX object common/CMakeFiles/llama-common.dir/debug.cpp.o |
| [350/451] Building CXX object common/CMakeFiles/llama-common.dir/fit.cpp.o |
| [351/451] Building CXX object common/CMakeFiles/llama-common.dir/download.cpp.o |
| [352/451] Building CXX object common/CMakeFiles/llama-common.dir/imatrix-loader.cpp.o |
| [353/451] Building CXX object common/CMakeFiles/llama-common.dir/hf-cache.cpp.o |
| [354/451] Building CXX object common/CMakeFiles/llama-common.dir/json-partial.cpp.o |
| [355/451] Building CXX object common/CMakeFiles/llama-common.dir/kv-mean-center.cpp.o |
| [356/451] Building CXX object common/CMakeFiles/llama-common.dir/llguidance.cpp.o |
| [357/451] Building CXX object common/CMakeFiles/llama-common.dir/log.cpp.o |
| [358/451] Building CXX object common/CMakeFiles/llama-common.dir/json-schema-to-grammar.cpp.o |
| [359/451] Building CXX object common/CMakeFiles/llama-common.dir/ngram-cache.cpp.o |
| [360/451] Building CXX object common/CMakeFiles/llama-common.dir/ngram-map.cpp.o |
| [361/451] Building CXX object common/CMakeFiles/llama-common.dir/ngram-mod.cpp.o |
| [362/451] Building CXX object common/CMakeFiles/llama-common.dir/preset.cpp.o |
| [363/451] Building CXX object common/CMakeFiles/llama-common.dir/regex-partial.cpp.o |
| [364/451] Building CXX object common/CMakeFiles/llama-common.dir/reasoning-budget.cpp.o |
| [365/451] Building CXX object common/CMakeFiles/llama-common.dir/sampling.cpp.o |
| [366/451] Building CXX object common/CMakeFiles/llama-common.dir/speculative.cpp.o |
| [367/451] Building CXX object common/CMakeFiles/llama-common.dir/peg-parser.cpp.o |
| [368/451] Building CXX object common/CMakeFiles/llama-common.dir/unicode.cpp.o |
| [369/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/lexer.cpp.o |
| [370/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/parser.cpp.o |
| [371/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/runtime.cpp.o |
| [372/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/string.cpp.o |
| [373/451] Building CUDA object common/CMakeFiles/llama-common.dir/dspark-markov.cu.o |
| [374/451] Building CXX object common/CMakeFiles/llama-common.dir/jinja/value.cpp.o |
| [375/451] Building CXX object vendor/cpp-httplib/CMakeFiles/cpp-httplib.dir/httplib.cpp.o |
| [376/451] Linking CXX static library vendor/cpp-httplib/libcpp-httplib.a |
| [377/451] Linking CXX shared library bin/libllama-common.so.0.0.1 |
| [378/451] Creating library symlink bin/libllama-common.so.0 bin/libllama-common.so |
| [379/451] Building CXX object tests/CMakeFiles/test-backend-ops.dir/get-model.cpp.o |
| [380/451] Building CXX object examples/training/CMakeFiles/llama-finetune.dir/finetune.cpp.o |
| [381/451] Linking CXX executable bin/llama-finetune |
| [382/451] Building CXX object tests/CMakeFiles/test-backend-ops.dir/test-backend-ops.cpp.o |
| [383/451] Linking CXX executable bin/test-backend-ops |
| [384/451] Building CXX object tools/completion/CMakeFiles/llama-completion.dir/main.cpp.o |
| [385/451] Building CXX object tools/ui/CMakeFiles/llama-ui-embed.dir/embed.cpp.o |
| [386/451] Linking CXX executable tools/ui/llama-ui-embed |
| [387/451] Building CXX object tools/completion/CMakeFiles/llama-completion-impl.dir/completion.cpp.o |
| [388/451] Linking CXX shared library bin/libllama-completion-impl.so |
| [389/451] Linking CXX executable bin/llama-completion |
| [390/451] Provisioning UI assets |
| -- UI: downloading from b1: https://huggingface.co/buckets/ggml-org/llama-ui/resolve/b1 |
| -- UI: download bundle.css from b1 failed: "HTTP response code said error" |
| -- UI: downloading from latest: https://huggingface.co/buckets/ggml-org/llama-ui/resolve/latest |
| -- UI: download bundle.css from latest failed: "HTTP response code said error" |
| -- UI: HF download failed |
| CMake Warning at /content/Prism-llama.cpp/scripts/ui-assets.cmake:348 (message): |
| UI: no assets available - building without an embedded UI. In a |
| disconnected environment, download the pre-built UI from a llama.cpp |
| release at https://github.com/ggml-org/llama.cpp/releases and extract to |
| tools/ui/dist. |
|
|
|
|
| [391/451] Building CXX object tools/ui/CMakeFiles/llama-ui.dir/ui.cpp.o |
| [392/451] Linking CXX static library tools/ui/libllama-ui.a |
| [393/451] Building CXX object tools/cli/CMakeFiles/llama-cli.dir/main.cpp.o |
| [394/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-chat.cpp.o |
| [395/451] Building CXX object tools/cli/CMakeFiles/llama-cli-impl.dir/cli.cpp.o |
| [396/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-queue.cpp.o |
| [397/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-task.cpp.o |
| [398/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-common.cpp.o |
| [399/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-tools.cpp.o |
| [400/451] Building CXX object tools/server/CMakeFiles/server-context.dir/server-context.cpp.o |
| [401/451] Building CXX object tools/server/CMakeFiles/llama-server-impl.dir/server.cpp.o |
| [402/451] Building CXX object tools/server/CMakeFiles/llama-server-impl.dir/server-http.cpp.o |
| [403/451] Building CXX object tools/server/CMakeFiles/llama-server.dir/main.cpp.o |
| [404/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/mtmd.cpp.o |
| [405/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/mtmd-audio.cpp.o |
| [406/451] Building CXX object tools/server/CMakeFiles/llama-server-impl.dir/server-models.cpp.o |
| [407/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/mtmd-image.cpp.o |
| [408/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/clip.cpp.o |
| [409/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/cogvlm.cpp.o |
| [410/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/mtmd-helper.cpp.o |
| [411/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/conformer.cpp.o |
| [412/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/dotsocr.cpp.o |
| [413/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/exaone4_5.cpp.o |
| [414/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/gemma4a.cpp.o |
| [415/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/gemma4v.cpp.o |
| [416/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/gemma4ua.cpp.o |
| [417/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/gemma4uv.cpp.o |
| [418/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/glm4v.cpp.o |
| [419/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/granite-speech.cpp.o |
| [420/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/granite4-vision.cpp.o |
| [421/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/hunyuanvl.cpp.o |
| [422/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/internvl.cpp.o |
| [423/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/kimivl.cpp.o |
| [424/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/kimik25.cpp.o |
| [425/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/nemotron-v2-vl.cpp.o |
| [426/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/llama4.cpp.o |
| [427/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/llava.cpp.o |
| [428/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/minicpmv.cpp.o |
| [429/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/paddleocr.cpp.o |
| [430/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/pixtral.cpp.o |
| [431/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/qwen2vl.cpp.o |
| [432/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/qwen3vl.cpp.o |
| [433/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/mimovl.cpp.o |
| [434/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/qwen3a.cpp.o |
| [435/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/step3vl.cpp.o |
| [436/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/siglip.cpp.o |
| [437/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/whisper-enc.cpp.o |
| [438/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/deepseekocr.cpp.o |
| [439/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/deepseekocr2.cpp.o |
| [440/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/mobilenetv5.cpp.o |
| [441/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/youtuvl.cpp.o |
| [442/451] Building CXX object tools/mtmd/CMakeFiles/mtmd.dir/models/yasa2.cpp.o |
| [443/451] Linking CXX shared library bin/libmtmd.so.0.0.1 |
| [444/451] Creating library symlink bin/libmtmd.so.0 bin/libmtmd.so |
| [445/451] Linking CXX static library tools/server/libserver-context.a |
| [446/451] Linking CXX shared library bin/libllama-cli-impl.so |
| [447/451] Linking CXX executable bin/llama-cli |
| [448/451] Linking CXX shared library bin/libllama-server-impl.so |
| [449/451] Linking CXX executable bin/llama-server |
| [450/451] Building CXX object tools/export-lora/CMakeFiles/llama-export-lora.dir/export-lora.cpp.o |
| [451/451] Linking CXX executable bin/llama-export-lora |
|
|
| RETURN CODE: 0 |
|
|
| ================================================================================================================ |
| BUILT BINARIES |
| ================================================================================================================ |
| [PASS] llama-cli: /content/Prism-llama.cpp/build/bin/llama-cli |
| size=17,888 bytes |
| sha256=bdbd81034512fdc6ae4a674a67ed50adb87c46b134b708609978880b0fc8a24c |
| [PASS] llama-completion: /content/Prism-llama.cpp/build/bin/llama-completion |
| size=15,968 bytes |
| sha256=698bdd659e5d1332ecc9da02448d60cfa650f8cbc754df5aa90f8da5c3d218b3 |
| [PASS] llama-server: /content/Prism-llama.cpp/build/bin/llama-server |
| size=17,896 bytes |
| sha256=903526b58a5cc21e208382f3f6d3d6ee272c9307908955fd2088aaa26d5fb3ab |
| [PASS] llama-finetune: /content/Prism-llama.cpp/build/bin/llama-finetune |
| size=40,648 bytes |
| sha256=f33b406af0091902ebe1ee183165b9f1f9cdb69206b96e08eda764a274cf158a |
| [PASS] llama-export-lora: /content/Prism-llama.cpp/build/bin/llama-export-lora |
| size=89,592 bytes |
| sha256=ec09b5231dc60859c4955d2bd88c3f84dd1b8421a4d8444ae5ab1b83130559ad |
| [PASS] test-backend-ops: /content/Prism-llama.cpp/build/bin/test-backend-ops |
| size=1,157,008 bytes |
| sha256=dc031c693d34dba11ae49a680e98d1ed66b1075daf4a14fb8d68a05408bb4506 |
|
|
| ================================================================================================================ |
| BINARY SMOKE TESTS |
| ================================================================================================================ |
|
|
| llama-cli: return_code=0 |
| ----- common params ----- |
|
|
| -h, --help, --usage print usage and exit |
| --version show version and build info |
| -cl, --cache-list show list of models in cache |
| --completion-bash print source-able bash completion script for llama.cpp |
| -t, --threads N number of CPU threads to use during generation (default: -1) |
| (env: LLAMA_ARG_THREADS) |
| -tb, --threads-batch N number of threads to use during batch and prompt processing (default: |
| same as --threads) |
| -C, --cpu-mask M CPU affinity mask: arbitrarily long hex. Complements cpu-range |
| (default: "") |
| -Cr, --cpu-range lo-hi range of CPUs for affinity. Complements --cpu-mask |
| --cpu-strict <0|1> use strict CPU placement (default: 0) |
| --prio N set process/thread priority : low(-1), normal(0), medium(1), high(2), |
| realtime(3) (default: 0) |
| --poll <0...100> use polling level to wait for work (0 - no polling, default: 50) |
| -Cb, --cpu-mask-batch M CPU affinity mask: arbitrarily long hex. Complements cpu-range-batch |
| (default: same as --cpu-mask) |
| -Crb, --cpu-range-batch lo-hi ranges of CPUs for affinity. Complements --cpu-mask-batch |
| --cpu-strict-batch <0|1> use strict CPU placement (default: same as --cpu-strict) |
| --prio-batch N set process/thread priority : 0-normal, 1-medium, 2-high, 3-realtime |
| (default: 0) |
| --poll-batch <0|1> use polling to wait for work (default: same as --poll) |
| -c, --ctx-size N size of the prompt context (default: 0, 0 = loaded from model) |
| (env: LLAMA_ARG_CTX_SIZE) |
| -n, --predict, --n-predict N number of tokens to predict (default: -1, -1 = infinity) |
| (env: LLAMA_ARG_N_PREDICT) |
| -b, --batch-size N logical maximum batch size (default: 2048) |
| (env: LLAMA_ARG_BATCH) |
|
|
| llama-completion: return_code=0 |
| ----- common params ----- |
|
|
| -h, --help, --usage print usage and exit |
| --version show version and build info |
| -cl, --cache-list show list of models in cache |
| --completion-bash print source-able bash completion script for llama.cpp |
| -t, --threads N number of CPU threads to use during generation (default: -1) |
| (env: LLAMA_ARG_THREADS) |
| -tb, --threads-batch N number of threads to use during batch and prompt processing (default: |
| same as --threads) |
| -C, --cpu-mask M CPU affinity mask: arbitrarily long hex. Complements cpu-range |
| (default: "") |
| -Cr, --cpu-range lo-hi range of CPUs for affinity. Complements --cpu-mask |
| --cpu-strict <0|1> use strict CPU placement (default: 0) |
| --prio N set process/thread priority : low(-1), normal(0), medium(1), high(2), |
| realtime(3) (default: 0) |
| --poll <0...100> use polling level to wait for work (0 - no polling, default: 50) |
| -Cb, --cpu-mask-batch M CPU affinity mask: arbitrarily long hex. Complements cpu-range-batch |
| (default: same as --cpu-mask) |
| -Crb, --cpu-range-batch lo-hi ranges of CPUs for affinity. Complements --cpu-mask-batch |
| --cpu-strict-batch <0|1> use strict CPU placement (default: same as --cpu-strict) |
| --prio-batch N set process/thread priority : 0-normal, 1-medium, 2-high, 3-realtime |
| (default: 0) |
| --poll-batch <0|1> use polling to wait for work (default: same as --poll) |
| -c, --ctx-size N size of the prompt context (default: 0, 0 = loaded from model) |
| (env: LLAMA_ARG_CTX_SIZE) |
| -n, --predict, --n-predict N number of tokens to predict (default: -1, -1 = infinity, -2 = until |
| context filled) |
| (env: LLAMA_ARG_N_PREDICT) |
| -b, --batch-size N logical maximum batch size (default: 2048) |
|
|
| llama-finetune: return_code=0 |
| ----- common params ----- |
|
|
| -h, --help, --usage print usage and exit |
| --version show version and build info |
| -cl, --cache-list show list of models in cache |
| --completion-bash print source-able bash completion script for llama.cpp |
| -t, --threads N number of CPU threads to use during generation (default: -1) |
| (env: LLAMA_ARG_THREADS) |
| -tb, --threads-batch N number of threads to use during batch and prompt processing (default: |
| same as --threads) |
| -C, --cpu-mask M CPU affinity mask: arbitrarily long hex. Complements cpu-range |
| (default: "") |
| -Cr, --cpu-range lo-hi range of CPUs for affinity. Complements --cpu-mask |
| --cpu-strict <0|1> use strict CPU placement (default: 0) |
| --prio N set process/thread priority : low(-1), normal(0), medium(1), high(2), |
| realtime(3) (default: 0) |
| --poll <0...100> use polling level to wait for work (0 - no polling, default: 50) |
| -Cb, --cpu-mask-batch M CPU affinity mask: arbitrarily long hex. Complements cpu-range-batch |
| (default: same as --cpu-mask) |
| -Crb, --cpu-range-batch lo-hi ranges of CPUs for affinity. Complements --cpu-mask-batch |
| --cpu-strict-batch <0|1> use strict CPU placement (default: same as --cpu-strict) |
| --prio-batch N set process/thread priority : 0-normal, 1-medium, 2-high, 3-realtime |
| (default: 0) |
| --poll-batch <0|1> use polling to wait for work (default: same as --poll) |
| -c, --ctx-size N size of the prompt context (default: 0, 0 = loaded from model) |
| (env: LLAMA_ARG_CTX_SIZE) |
| -n, --predict, --n-predict N number of tokens to predict (default: -1, -1 = infinity) |
| (env: LLAMA_ARG_N_PREDICT) |
| -b, --batch-size N logical maximum batch size (default: 2048) |
| (env: LLAMA_ARG_BATCH) |
|
|
| llama-export-lora: return_code=0 |
| ----- common params ----- |
|
|
| -h, --help, --usage print usage and exit |
| --version show version and build info |
| -cl, --cache-list show list of models in cache |
| --completion-bash print source-able bash completion script for llama.cpp |
| -t, --threads N number of CPU threads to use during generation (default: -1) |
| (env: LLAMA_ARG_THREADS) |
| -tb, --threads-batch N number of threads to use during batch and prompt processing (default: |
| same as --threads) |
| -C, --cpu-mask M CPU affinity mask: arbitrarily long hex. Complements cpu-range |
| (default: "") |
| -Cr, --cpu-range lo-hi range of CPUs for affinity. Complements --cpu-mask |
| --cpu-strict <0|1> use strict CPU placement (default: 0) |
| --prio N set process/thread priority : low(-1), normal(0), medium(1), high(2), |
| realtime(3) (default: 0) |
| --poll <0...100> use polling level to wait for work (0 - no polling, default: 50) |
| -Cb, --cpu-mask-batch M CPU affinity mask: arbitrarily long hex. Complements cpu-range-batch |
| (default: same as --cpu-mask) |
| -Crb, --cpu-range-batch lo-hi ranges of CPUs for affinity. Complements --cpu-mask-batch |
| --cpu-strict-batch <0|1> use strict CPU placement (default: same as --cpu-strict) |
| --prio-batch N set process/thread priority : 0-normal, 1-medium, 2-high, 3-realtime |
| (default: 0) |
| --poll-batch <0|1> use polling to wait for work (default: same as --poll) |
| -c, --ctx-size N size of the prompt context (default: 0, 0 = loaded from model) |
| (env: LLAMA_ARG_CTX_SIZE) |
| -n, --predict, --n-predict N number of tokens to predict (default: -1, -1 = infinity) |
| (env: LLAMA_ARG_N_PREDICT) |
| -b, --batch-size N logical maximum batch size (default: 2048) |
| (env: LLAMA_ARG_BATCH) |
|
|
| test-backend-ops: return_code=1 |
| Usage: /content/Prism-llama.cpp/build/bin/test-backend-ops [mode] [-o <op,..>] [-b <backend>] [-p <params regex>] [--output <console|sql|csv>] [--list-ops] [--show-coverage] [--test-file <path>] [-j <n>] |
| valid modes: |
| - test (default, compare with CPU backend for correctness) |
| - grad (compare gradients from backpropagation with method of finite differences) |
| - perf (performance evaluation) |
| - support (probe backend operation support) |
| op names for -o are as given by ggml_op_desc() (e.g. ADD, MUL_MAT, etc), |
| optionally including the full test case string (e.g. "ADD(type=f16,ne=[1,1,8,1],nr=[1,1,1,1],nf=1)") |
| --output specifies output format (default: console, options: console, sql, csv) |
| --list-ops lists all available GGML operations |
| --show-coverage shows test coverage |
| --test-file reads test operators from a test file generated by llama-export-graph-ops |
| -j <n> runs tests using <n> parallel worker threads (default: 1, test mode only) |
|
|
| ================================================================================================================ |
| SOURCE HASH BASELINE |
| ================================================================================================================ |
| 8fe7c384f84fcb9c0b396f2aba9122c0a9f0172260f7a7bd4bedfdd2c627f171 ggml/src/ggml-cuda/mmq.cu |
| ab36e05057c754f016ef229f478d9c871e2bb1502c1059bc21e7f777b80bb83a ggml/src/ggml-cuda/mmq.cuh |
| 637928070f54fd92749b83bd1ebce2bf101ad9fe3989afe52ab48dcefc9855b4 ggml/src/ggml-cuda/out-prod.cu |
| e91732f059f13cbb4ef62ed4435738db5d22e24d77bad7f727d5b7919beadfcf ggml/src/ggml-cuda/ggml-cuda.cu |
| 24a0615d0feb09b6041528215bef01cc0c2aba35b8cd49f8164ace49abb1a997 ggml/src/ggml.c |
| d1f710b1ea3aa0f7da5f698a8a6a7e3b19adfc87c329ebc0b70ee0ac667efa4c tests/test-backend-ops.cpp |
| 276e5410995dab8ca4cbb8448270c59836488e22be916e2004cc4fb1129ebd17 examples/training/finetune.cpp |
| f593edae28d12e4ed59c7211e74779680b9af28f34f590103f446d659874681b src/llama-adapter.cpp |
|
|
| ================================================================================================================ |
| CMAKE CACHE SUMMARY |
| ================================================================================================================ |
| BUILD_TESTING:BOOL=ON |
| CMAKE_BUILD_TYPE:STRING=Release |
| CMAKE_CUDA_ARCHITECTURES:UNINITIALIZED=89 |
| GGML_CCACHE:BOOL=ON |
| GGML_CCACHE_FOUND:FILEPATH=/usr/bin/ccache |
| GGML_CUDA:BOOL=ON |
| GGML_CUDA_COMPRESSION_MODE:STRING=size |
| GGML_CUDA_CUTLASS_DIR:PATH= |
| GGML_CUDA_FA:BOOL=ON |
| GGML_CUDA_FA_ALL_QUANTS:BOOL=OFF |
| GGML_CUDA_FORCE_CUBLAS:BOOL=OFF |
| GGML_CUDA_FORCE_MMQ:BOOL=OFF |
| GGML_CUDA_GRAPHS:BOOL=ON |
| GGML_CUDA_HOPPER_Q1:BOOL=OFF |
| GGML_CUDA_NCCL:BOOL=ON |
| GGML_CUDA_NO_PEER_COPY:BOOL=OFF |
| GGML_CUDA_NO_VMM:BOOL=OFF |
| GGML_CUDA_PEER_MAX_BATCH_SIZE:STRING=128 |
| LLAMA_BUILD_COMMON:BOOL=ON |
| LLAMA_BUILD_EXAMPLES:BOOL=ON |
| LLAMA_BUILD_SERVER:BOOL=ON |
| LLAMA_BUILD_TESTS:BOOL=ON |
| LLAMA_BUILD_TOOLS:BOOL=ON |
| GGML_CUDA_COMPRESSION_MODE-STRINGS:INTERNAL=none;speed;balance;size |
|
|
| ================================================================================================================ |
| CCACHE SUMMARY |
| ================================================================================================================ |
| Summary: |
| Hits: 0 / 422 (0.00 %) |
| Direct: 0 / 422 (0.00 %) |
| Preprocessed: 0 / 422 (0.00 %) |
| Misses: 422 |
| Direct: 422 |
| Preprocessed: 422 |
| Primary storage: |
| Hits: 0 / 844 (0.00 %) |
| Misses: 844 |
| Cache size (GB): 0.06 / 10.00 (0.63 %) |
|
|
| Use the -v/--verbose option for more details. |
| Return code: 0 |
|
|
| ================================================================================================================ |
| FINAL GIT STATE |
| ================================================================================================================ |
| Working tree status: <clean> |
| Status command return code: 0 |
|
|
| ================================================================================================================ |
| FINAL RESULT |
| ================================================================================================================ |
| [PASS] Fresh Colab dependencies installed. |
| [PASS] CUDA runtime and nvcc verified. |
| [PASS] Official Prism repository fetched. |
| [PASS] Exact Prism commit verified. |
| [PASS] Clean detached source checkout created. |
| [PASS] CUDA SM architecture configured. |
| [PASS] Examples, tools, server and tests enabled. |
| [PASS] llama-cli built. |
| [PASS] llama-completion built. |
| [PASS] llama-server built. |
| [PASS] llama-finetune built. |
| [PASS] llama-export-lora built. |
| [PASS] test-backend-ops built. |
| [PASS] Source hash baseline recorded. |
| [PASS] Project configuration written. |
| [PASS] Reusable path helper written. |
|
|
| Status: PASS |
| Elapsed: 33:26 |
|
|
| No Prism source patches have been applied. |
| No model has been downloaded. |
| No training has been started. |
|
|
| The next implementation stage is the isolated exact training-forward primitive: |
| packed Q1 weight × F32 activation -> F32 output |
| with Q1 signs/scales decoded only inside the CUDA kernel. |
|
|