GGUF DFlash draft models for speculative decoding, including Qwen, Kimi, Gemma, MiniMax, and GPT-OSS.