primitive-ai/Nemotron-3.5-Lightning-30B-A3B-mixed-INT4-INT8 Text Generation • 34B • Updated Aug 29 • 273 • 4
Running 213 The ultimate guide to multi-harness RL 🔀 213 Train open models with RL inside real agent harnesses
XiaomiMiMo/MiMo-V2.6-Flash-RL Text Generation • 311B • Updated about 8 hours ago • 56.3k • • 546
prism-ml/Ternary-Bonsai-2-27B-mlx-2bit Text Generation • 27B • Updated 17 days ago • 77.6k • 437
nvidia/NVIDIA-Nemotron-Nano-12B-v2-VL-FP8 Image-Text-to-Text • 13B • Updated Sep 2 • 29.4k • 53
nvidia/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16 Any-to-Any • 33B • Updated Aug 24 • 352k • 437
DataFlex-RL: An Evaluation Platform for RLVR Data Policies Paper • 2609.06107 • Published Sep 5 • 166