RRSI: Regularized Recursive Self-Improvement of Agent Harnesses Paper • 2609.24972 • Published 2 days ago • 145
SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning Paper • 2602.08234 • Published Feb 9 • 76
view article Article Proof of Time: A Benchmark for Evaluating Scientific Idea Judgments shanchen • Jan 13 • 10
view article Article Proof of Time: A Benchmark for Evaluating Scientific Idea Judgments shanchen • Jan 13 • 10
Agent0: Unleashing Self-Evolving Agents from Zero Data via Tool-Integrated Reasoning Paper • 2511.16043 • Published Nov 20, 2025 • 110
view article Article Budget Alignment: Making Models Reason in the User’s Language shanchen • Nov 4, 2025 • 12
view article Article Budget Alignment: Making Models Reason in the User’s Language shanchen • Nov 4, 2025 • 12
Scaling Latent Reasoning via Looped Language Models Paper • 2510.25741 • Published Oct 29, 2025 • 236
view article Article What We Learned About LLM/VLMs in Healthcare AI Evaluation: shanchen • Nov 8, 2024 • 17