mradermacher/Hemlock-Apothecary-7B-GRPO-e3-i1-GGUF Reinforcement Learning • 8B • Updated 16 days ago • 2.88k
mradermacher/Hemlock2-Coder-7B-GRPO-i1-GGUF Reinforcement Learning • 8B • Updated 16 days ago • 1.92k