Do Video Generators Track the World Across Segments? A Benchmark and Method for World-State Reasoning in Video Continuation Paper • 2609.03673 • Published 5 days ago
Evaluation-Verification Reward for Consistent Multi-Reference Image Editing Paper • 2607.29025 • Published Jul 31 • 17
DreamX-Creator: Democratizing Native Audio-Video Generation at 2K Resolution Paper • 2608.31106 • Published 8 days ago • 99
Evaluation-Verification Reward for Consistent Multi-Reference Image Editing Paper • 2607.29025 • Published Jul 31 • 17
DreamX-Phi 1.0: Action-Conditioned Video World Model for Robotic Manipulation Paper • 2608.13489 • Published 26 days ago • 99
LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks Paper • 2608.01964 • Published Aug 3 • 183
Open-AoE: An Open Egocentric Manipulation Dataset and Toolchain for Embodied Learning Paper • 2607.14183 • Published Jul 15 • 67
OmniDance: Multimodal Driven Dance Video Generation with Large-scale Internet Data Paper • 2606.30019 • Published Jun 29 • 19
BlockPilot: Instance-Adaptive Policy Learning for Diffusion-based Speculative Decoding Paper • 2606.31315 • Published Jun 30 • 77
DreamX-World 1.0: A General-Purpose Interactive World Model Paper • 2606.16993 • Published Jun 15 • 115
Role-Agent: Bootstrapping LLM Agents via Dual-Role Evolution Paper • 2606.10917 • Published Jun 9 • 77
TransitLM: A Large-Scale Dataset and Benchmark for Map-Free Transit Route Generation Paper • 2605.22355 • Published May 21 • 179