Running 184 The ultimate guide to multi-harness RL 🔀 184 Train open models with RL inside real agent harnesses
Running 258 The ultimate guide to RL environments: building and scaling them in the LLM era 📝 258 Building and scaling RL environments for LLM training
Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots
microsoft/tapex-large-finetuned-wtq Table Question Answering • 0.4B • Updated Jan 12, 2024 • 824 • 79