Using Grounded Theory for Agent Behavior Analysis at Scale Paper • 2608.30391 • Published 18 days ago • 19
PACE: Towards Surfacing Hidden Conflicts in User Requests Paper • 2609.03293 • Published 15 days ago • 24
CORE: Improving Compositional Reasoning in MLLM Embedding via Reranker Distillation Paper • 2609.04083 • Published 15 days ago • 27
Rethinking On-Policy Distillation of Large Language Models II: One Training Example Paper • 2609.04172 • Published 15 days ago • 98
Puffin-World: Scaling a Unified Multimodal Model with Native 3D World States Paper • 2609.04196 • Published 15 days ago • 69
Random Attention: Rethinking KV Cache Eviction for Efficient Reasoning Paper • 2609.03430 • Published 15 days ago • 186
Compile by Training: Turning Natural-Language Specifications into Local Neural Functions Paper • 2609.04199 • Published 15 days ago • 385
LatentPress: Context Compression Beyond Text and Vision Paper • 2609.01507 • Published 17 days ago • 121
LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes Paper • 2609.03796 • Published 15 days ago • 236
Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments Paper • 2609.04148 • Published 15 days ago • 296
DVAO: Dynamic Variance-adaptive Advantage Optimization for Multi-reward Reinforcement Learning Paper • 2605.25604 • Published May 25 • 139