Kaininja: Extending Native 3D Generators to the Part Level Paper • 2609.15659 • Published 12 days ago • 18
Scal3R: Learning Efficient Multi-Relative Pose Query for Scalable Online 3D Reconstruction Paper • 2609.04201 • Published 23 days ago • 50
Alaya-EVOKE: From Linear-Scaling Supervision to Endless World Paper • 2608.13546 • Published Aug 13 • 142
Marionette: Predicting World States, Rendering Geometry, Painting Appearance Paper • 2608.14530 • Published Aug 14 • 35
DF3DV-1K: A Large-Scale Dataset and Benchmark for Distractor-Free Novel View Synthesis Paper • 2604.13416 • Published Jun 18 • 34
JanusMesh: Fast and Zero-Shot 3D Visual Illusion Generation via Cross-Space Denoising Paper • 2606.20563 • Published Jun 18 • 22
Thinking in Blender: Staged Executable Inverse Graphics with Vision-Language Models Paper • 2606.02580 • Published Jun 1 • 4
Reroute, Don't Remove: Recoverable Visual Token Routing for Vision-Language Models Paper • 2606.12412 • Published Jun 10 • 21
YoCausal: How Far is Video Generation from World Model? A Causality Perspective Paper • 2605.30346 • Published May 28 • 53
DINOv3 Collection DINOv3: foundation models producing excellent dense features, outperforming SotA w/o fine-tuning - https://arxiv.org/abs/2508.10104 • 15 items • Updated Mar 10 • 786
Pantheon360: Taming Digital Twin Generation via 3D-Aware 360° Video Diffusion Paper • 2605.25449 • Published May 25 • 23
PhaSR: Generalized Image Shadow Removal with Physically Aligned Priors Paper • 2601.17470 • Published Jan 24 • 21
ReflexSplit: Single Image Reflection Separation via Layer Fusion-Separation Paper • 2601.17468 • Published Jan 24 • 25
Stroke of Surprise: Progressive Semantic Illusions in Vector Sketching Paper • 2602.12280 • Published Feb 12 • 34
3AM: Segment Anything with Geometric Consistency in Videos Paper • 2601.08831 • Published Jan 13 • 34
AdaGaR: Adaptive Gabor Representation for Dynamic Scene Reconstruction Paper • 2601.00796 • Published Jan 2 • 32