Rethinking Latent Visual Reasoning: Grounding Latent Reasoning in Visual Evidence Paper • 2609.34563 • Published 5 days ago • 208
I Have a Stream: Making Self-Supervised Learning Work on Continuous Video Paper • 2609.40333 • Published 3 days ago • 12
DC-SAE: Deep Compression Semantic Autoencoder for Faster Diffusion Convergence Paper • 2609.39222 • Published 3 days ago • 36
Imagine3D-LLM: Teaching MLLMs to Imagine 3D Scenes Before Answering Paper • 2609.38177 • Published 4 days ago • 59