Inference Providers
Active filters: prm
jacopo-minniti/Qwen2.5-Math-7B-PUM
Token Classification
• 7B • Updated • 8
jacopo-minniti/Qwen2.5-Math-7B-PUM-half_entropy
Token Classification
• 7B • Updated • 5
jacopo-minniti/Qwen2.5-Math-7B-PUM-soft-classification
2B • Updated • 8
alothomas/Qwen2.5-0.5B-PRM-RAD-balanced-150k-LastStepOnly
Token Classification
• 0.5B • Updated • 3
jacopo-minniti/Qwen2.5-Math-1.5B-PUM-variance
2B • Updated • 4
jacopo-minniti/Qwen2.5-Math-1.5B-PUM-binary-variance
Token Classification
• 2B • Updated • 4
jacopo-minniti/Qwen2.5-Math-1.5B-PUM-entropy_binary
Token Classification
• 2B • Updated • 3
yungshun317/qwen2.5-0.5B-prm-mathshepherd
Token Classification
• 0.5B • Updated • 4
jacopo-minniti/R1-Qwen-MMLU-1.5B-PUM-Variance
2B • Updated • 49
jacopo-minniti/R1-Qwen-MMLU-1.5B-PRM
2B • Updated • 10
jacopo-minniti/R1-Qwen-MMLU-1.5B-PRM-Regression
2B • Updated • 13
Text Generation
• 196k • Updated • 28
mradermacher/GPRM-4B-GGUF
Reinforcement Learning
• 4B • Updated • 98
94.4M • Updated • 16
MinKeonKim/PRO-STEP-PRM-8B
Diginyx/Qwen3.5-27B-prm-ep1
Text Classification
• Updated • 3
AetherPrior/qwen3-8b-impl-prm-exec-think
Text Classification
• 2B • Updated • 291