PAST-Bench: Benchmarking the Foundations of Recursive Self-Improvement in Personal Agents Paper • 2608.04003 • Published 2 days ago • 28
JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion Paper • 2608.03974 • Published 2 days ago • 77
Hunyuan3D-Buffalo 1.0: A Unified Multimodal Model for Scalable 3D Generation, Understanding, and Editing Paper • 2608.02711 • Published 3 days ago • 71
Evaluation-Verification Reward for Consistent Multi-Reference Image Editing Paper • 2607.29025 • Published 6 days ago • 15
ExtractBench: A Benchmark for Schema-Guided Enterprise Document Extraction Paper • 2607.29677 • Published 6 days ago • 19
Meshy T2: Fast Native Mesh Generation with Flow Matching Paper • 2607.28675 • Published 9 days ago • 53
ReToken: One Token to Improve Vision-Language Models for Visual Retrieval Paper • 2607.28627 • Published 7 days ago • 8
Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Paper • 2607.28611 • Published 7 days ago • 20
ACE-Data-0: Human-Centric Ambient Capture as Embodied Data Engine Paper • 2607.28625 • Published 7 days ago • 43
PhiZero: A World Model Built Around Physical Language Paper • 2607.28624 • Published 7 days ago • 166
OmegaUse-OfficeVal: Benchmarking LLM Agents on Long-Horizon Office-Suite Tasks with Economic Grounding Paper • 2607.27155 • Published 8 days ago • 12
Can AI agents conduct open-ended AI research? Early evidence from two case studies Paper • 2607.27191 • Published 8 days ago • 18
PerceptionBench: Evaluating Atomic Visual Perception in Multimodal Large Language Models Paper • 2607.24957 • Published 10 days ago • 18
OmniDelta: Skill-Driven Budget Allocation for Token Compression in OmniLLMs Paper • 2607.25669 • Published 9 days ago • 9
GNM Head: A Generative aNthropometric Model of the human head Paper • 2607.23687 • Published 11 days ago • 5