AdAM: Few-Shot Image Generation via Adaptation-Aware Kernel Modulation Paper • 2307.01465 • Published Nov 10, 2023
JarvisHub: An Open Harness for Canvas-Native Multimodal Creative Agents Paper • 2607.23588 • Published 3 days ago • 108
Monocular Normal Estimation via Shading Sequence Estimation Paper • 2602.09929 • Published Feb 10 • 1
CodeDance: A Dynamic Tool-integrated MLLM for Executable Visual Reasoning Paper • 2512.17312 • Published Dec 19, 2025 • 3
TimeExpert: An Expert-Guided Video LLM for Video Temporal Grounding Paper • 2508.01699 • Published Aug 3, 2025
Text4Seg++: Advancing Image Segmentation via Generative Language Modeling Paper • 2509.06321 • Published Sep 8, 2025
Few-shot Image Generation via Adaptation-Aware Kernel Modulation Paper • 2210.16559 • Published Oct 29, 2022 • 1
Revisiting Label Smoothing and Knowledge Distillation Compatibility: What was Missing? Paper • 2206.14532 • Published Jun 29, 2022 • 1
On Evaluating Adversarial Robustness of Large Vision-Language Models Paper • 2305.16934 • Published May 26, 2023
JarvisHub: An Open Harness for Canvas-Native Multimodal Creative Agents Paper • 2607.23588 • Published 3 days ago • 108
EvalVerse: Pipeline-Aware and Expert-Calibrated Benchmarking for Professional Cinematic Video Generation Paper • 2605.23271 • Published May 22 • 82
CodeDance: A Dynamic Tool-integrated MLLM for Executable Visual Reasoning Paper • 2512.17312 • Published Dec 19, 2025 • 3
Imperceptible Jailbreaking against Large Language Models Paper • 2510.05025 • Published Oct 6, 2025 • 33