FAMOS: Feed-Forward 3D Articulation Modeling from Sparse Observations Paper • 2609.20817 • Published 22 days ago • 40
Studying Image Tokenizers as Visual Languages in Unified Multimodal Models Paper • 2609.09143 • Published about 1 month ago • 29
Measuring Language Transfer in Robot Policies: Adding Greek to a Cosmos3 Vision-Language-Action Policy Paper • 2609.07470 • Published Sep 7 • 23