When to Switch: Reliable Action-Chunk Extension for Vision-Language-Action Models Paper • 2610.05719 • Published 2 days ago • 13
PointWAM: 3D World Action Modeling for Dexterous Robotic Manipulation Paper • 2610.02840 • Published 5 days ago • 43
Cog3DMap: Multi-View Vision-Language Reasoning with 3D Cognitive Maps Paper • 2603.23023 • Published Mar 24 • 22
Planning in 8 Tokens: A Compact Discrete Tokenizer for Latent World Model Paper • 2603.05438 • Published Mar 5 • 41