Audio-Visual Flamingo: Open Audio-Visual Intelligence for Long and Complex Videos Paper ⢠2607.16107 ⢠Published Jul 17 ⢠11
Nemotron-Labs-Audex Collection Unified Audio Intelligence Without Regressing on Text Intelligence ⢠4 items ⢠Updated 11 days ago ⢠9
Unified Audio Intelligence Without Regressing on Text Intelligence Paper ⢠2607.05196 ⢠Published Jul 6 ⢠24
PersonaPlex: Voice and Role Control for Full Duplex Conversational Speech Models Paper ⢠2602.06053 ⢠Published Jan 14 ⢠9
Audio Flamingo Next: Next-Generation Open Audio-Language Models for Speech, Sound, and Music Paper ⢠2604.10905 ⢠Published Apr 13 ⢠29
Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language Models Paper ⢠2507.08128 ⢠Published Jul 10, 2025 ⢠16
Negative-Guided Subject Fidelity Optimization for Zero-Shot Subject-Driven Generation Paper ⢠2506.03621 ⢠Published Jun 4, 2025 ⢠22
Cosmos-Preidct1 Collection ā ļø This collection is archived. š https://huggingface.co/collections/nvidia/cosmos3 ⢠14 items ⢠Updated 11 days ago ⢠304
PHI-S: Distribution Balancing for Label-Free Multi-Teacher Distillation Paper ⢠2410.01680 ⢠Published Oct 2, 2024 ⢠34