4DAnyone: Create Anyone in 4D from a Casual Monocular Video Paper • 2608.20335 • Published 3 days ago • 62
Perceptio: Perception Enhanced Vision Language Models via Spatial Token Generation Paper • 2603.18795 • Published Mar 19 • 17