Running Agents 435 Reward Bench Leaderboard π 435 Explore and compare model scores on RewardBench benchmarks
TinyLlama/TinyLlama-1.1B-Chat-v1.0 Text Generation β’ 1B β’ Updated Mar 17, 2024 β’ 2.34M β’ β’ 1.72k
Running Agents 95 Nexus Function Calling Leaderboard π 95 Display benchmark results for models on various tasks
Running on CPU Upgrade 14.1k Open LLM Leaderboard π 14.1k Track, rank and evaluate open LLMs and chatbots