mradermacher/MARSHAL-Generalist-Qwen3-4B-GGUF Reinforcement Learning • 4B • Updated Dec 2, 2025 • 128