LLMBox: A Comprehensive Library for Large Language Models Paper • 2407.05563 • Published Jul 8, 2024 • 2
Technical Report: Enhancing LLM Reasoning with Reward-guided Tree Search Paper • 2411.11694 • Published Nov 18, 2024 • 2
Challenging the Boundaries of Reasoning: An Olympiad-Level Math Benchmark for Large Language Models Paper • 2503.21380 • Published Mar 27, 2025 • 40
Which Models Are Our Models Built On? Auditing Invisible Dependencies in Modern LLMs Paper • 2606.12385 • Published Jun 10 • 5
RoboCoach: World Models as Active Coaches for Compositional Robot Skills Paper • 2609.39685 • Published 2 days ago • 13