OmniVChat: Synthesizing, Benchmarking, and Training for Native Audio-Visual Dialogue Paper • 2609.21465 • Published 8 days ago • 145
Codec Does Matter: Exploring the Semantic Shortcoming of Codec for Audio Language Model Paper • 2408.17175 • Published Aug 30, 2024 • 6
MusicScore: A Dataset for Music Score Modeling and Generation Paper • 2406.11462 • Published Jun 17, 2024
Summary of DCASE 2026 Task 5: Audio-Dependent Question Answering Paper • 2607.18718 • Published Jul 21
Measuring Audio's Impact on Correctness: Audio-Contribution-Aware Post-Training of Large Audio Language Models Paper • 2509.21060 • Published Sep 25, 2025 • 2
Talker-T2AV: Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling Paper • 2604.23586 • Published Apr 26 • 7