AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning Paper • 2608.05987 • Published 5 days ago • 88
CAST: Game Solvers as Turn-Level Teachers for LLM Agents Paper • 2607.25308 • Published 14 days ago • 41
MeKi: Memory-based Expert Knowledge Injection for Efficient LLM Scaling Paper • 2602.03359 • Published Feb 3 • 10