Running on CPU Upgrade 14.1k Open LLM Leaderboard ๐ 14.1k Track, rank and evaluate open LLMs and chatbots
Running Agents 1.52k Big Code Models Leaderboard ๐ 1.52k Explore code model leaderboard and submit evaluations
Runtime error Agents Featured 437 Open Medical-LLM Leaderboard ๐ฅ 437 Explore and submit models for benchmarking
Running 138 Open FinLLM Leaderboard ๐ฅ 138 Explore and compare LLM performance on financial benchmarks