SpatialBlock: Enhancing Spatial Intelligence in LVLMs via Synthetic Block-Stacking Problem Paper • 2609.07064 • Published 6 days ago • 90
AVA-Encoder: Towards Agent-Native Video Representation Learning Paper • 2608.12313 • Published Aug 12 • 43
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published Aug 1 • 263
Articulated Object Reconstruction from Rest-State Observation Paper • 2607.27749 • Published Jul 30 • 51
Teaching Nemotron Greek: Mining a Corpus, Adapting Retrieval, and Grounding Generation for Modern Greek across Specialist Domains Paper • 2608.05138 • Published Aug 5 • 32
ContextMaster: Interactive Multi-Shot Video Creation via Fixed-Budget Sparse Context Routing Paper • 2608.04956 • Published Aug 5 • 16
Evaluation-Verification Reward for Consistent Multi-Reference Image Editing Paper • 2607.29025 • Published Jul 31 • 17