q1716523669/mllm-mmr1-gt-gemma3-4b-full-best-s140 Reinforcement Learning • 769k • Updated 5 days ago • 90
q1716523669/mllm-mmr1-gt-gemma3-4b-full-end-s722 Reinforcement Learning • 769k • Updated 5 days ago • 21
q1716523669/mllm-mmr1-ttrl-gemma3-4b-full-best-s540 Reinforcement Learning • 769k • Updated 5 days ago • 54
q1716523669/mllm-mmr1-ttrl-gemma3-4b-full-end-s722 Reinforcement Learning • 769k • Updated 5 days ago • 19
q1716523669/mllm-mmr1-gt-qwen25vl-3b-full-best-s140 Reinforcement Learning • 756k • Updated 4 days ago • 23
q1716523669/mllm-mmr1-gt-qwen25vl-3b-full-end-s722 Reinforcement Learning • 756k • Updated 4 days ago • 17
q1716523669/mllm-mmr1-ttrl-qwen25vl-3b-full-best-s100 Reinforcement Learning • 756k • Updated 4 days ago • 18
q1716523669/mllm-mmr1-ttrl-qwen25vl-3b-full-end-s722 Reinforcement Learning • 756k • Updated 4 days ago • 19
q1716523669/mllm-mmr1-gt-internvl35-2b-full-best-s440 Reinforcement Learning • 2B • Updated about 7 hours ago
q1716523669/mllm-mmr1-gt-internvl35-2b-full-end-s722 Reinforcement Learning • 2B • Updated about 7 hours ago