Spike tool-calling assistants for llama.cpp — GGUF (Q4_K_M + F16). Qwen3.5 2B/4B/9B + Pieswap 350M: tools + thinking ~99.8%. EN/DE.