parakon-runtime / examples /model-conversion /scripts /utils /run-embedding-server.sh

Commit History

Parakon runtime: llama.cpp fork with fused 1-bit CUDA/Metal/CPU kernels (part 3)
7011d4a
verified

kat0012 commited on