rankings Running on CPU Upgrade 7.64k MTEB Leaderboard 📊 7.64k Embedding Leaderboard Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots Running Agents 436 Reward Bench Leaderboard 📐 436 Explore and compare model scores on RewardBench benchmarks
Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots
Running Agents 436 Reward Bench Leaderboard 📐 436 Explore and compare model scores on RewardBench benchmarks
datasets argilla/distilabel-intel-orca-dpo-pairs Viewer • Updated Aug 7, 2025 • 12.9k • 13.9k • 182 m-a-p/Code-Feedback Viewer • Updated Feb 26, 2024 • 66.4k • 3.11k • 240 argilla/ultrafeedback-binarized-preferences-cleaned Viewer • Updated Dec 11, 2023 • 60.9k • 16.7k • 163 kyujinpy/orca_math_dpo Viewer • Updated Apr 12, 2024 • 15.3k • 51 • 20
argilla/ultrafeedback-binarized-preferences-cleaned Viewer • Updated Dec 11, 2023 • 60.9k • 16.7k • 163
rankings Running on CPU Upgrade 7.64k MTEB Leaderboard 📊 7.64k Embedding Leaderboard Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots Running Agents 436 Reward Bench Leaderboard 📐 436 Explore and compare model scores on RewardBench benchmarks
Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots
Running Agents 436 Reward Bench Leaderboard 📐 436 Explore and compare model scores on RewardBench benchmarks
datasets argilla/distilabel-intel-orca-dpo-pairs Viewer • Updated Aug 7, 2025 • 12.9k • 13.9k • 182 m-a-p/Code-Feedback Viewer • Updated Feb 26, 2024 • 66.4k • 3.11k • 240 argilla/ultrafeedback-binarized-preferences-cleaned Viewer • Updated Dec 11, 2023 • 60.9k • 16.7k • 163 kyujinpy/orca_math_dpo Viewer • Updated Apr 12, 2024 • 15.3k • 51 • 20
argilla/ultrafeedback-binarized-preferences-cleaned Viewer • Updated Dec 11, 2023 • 60.9k • 16.7k • 163