TempCloze: Can Video-LLMs Identify the Missing Middle? Paper • 2609.01515 • Published 11 days ago • 17
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published Aug 1 • 263
Not Worth Another Token: Marginal Value Estimation for Efficient Deep Research Agents Paper • 2608.08389 • Published Aug 9 • 12
GST-Bench: Can VLMs Develop Global Spatial Awareness from Video? Paper • 2608.05747 • Published Aug 6 • 46
DreamTraj: Generating 6-DoF Object Trajectories by Reading Unrendered Video Diffusion Latents Paper • 2608.00486 • Published Aug 1 • 15
Scaling Properties of Text Conditioning in Visual Generation Paper • 2607.29679 • Published Jul 31 • 41