FrugalEvo: Towards Cost-Aware LLM-Guided Program Evolution Paper • 2610.03675 • Published 8 days ago • 29
RealCompanion: Benchmarking Human Understanding from Reasoning over Longitudinal Real-World Conversations Paper • 2610.01780 • Published 9 days ago • 278
MetaRubric: Learning to Reward for Rubric-Based Reinforcement Learning Paper • 2610.02824 • Published 8 days ago • 33
Rethinking Latent Visual Reasoning: Grounding Latent Reasoning in Visual Evidence Paper • 2609.34563 • Published 12 days ago • 218
Label-free steering: Compressing test-time reinforcement learning into bias-only subspaces Paper • 2609.18587 • Published 12 days ago • 5
BIABench: Evaluating AI agents on real-world bioimage analysis tasks Paper • 2609.34274 • Published 12 days ago • 5
Aligning One-Step Generative Models with Reward-Weighted Transport Distillation Paper • 2609.30840 • Published 15 days ago • 3
Not Every Token Is Worth Distilling: Selective Supervision for Direct-OPD Paper • 2609.29142 • Published 14 days ago • 6
The Evolution of Attention in Large Language Models: Mechanisms, Trade-offs, and Emerging Trends Paper • 2609.39661 • Published 10 days ago • 13
MILO: Automated Harness Discovery via Orchestrated Multi-Agent Evolution Paper • 2609.38349 • Published 11 days ago • 22