Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments Paper • 2609.04148 • Published 1 day ago • 180
PaperGym: Rubric-Centered Evolution for Research-Plan Generation Paper • 2608.31119 • Published 5 days ago • 38
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning Paper • 2608.05987 • Published 30 days ago • 101
CreativeBench: Benchmarking and Enhancing Machine Creativity via Self-Evolving Challenges Paper • 2603.11863 • Published Mar 12 • 8