Zero-WAM: In-Context World-Action Modeling from Human Videos for Open-Ended Task Generalization
Paper • 2608.26103 • Published • 16
Embodied AI
Zero-WAM: In-Context World-Action Modeling from Human Videos for Open-Ended Task Generalization
4DAnyone: Create Anyone in 4D from a Casual Monocular Video