audeering/wav2vec2-large-robust-24-ft-age-gender Audio Classification • 0.3B • Updated Mar 24, 2025 • 2.35M • 63
Running Agents 164 Qwen3.5 Omni Offline Demo 🌍 164 Chat with a multimodal AI using text, audio, images or video
SpeakerLM: End-to-End Versatile Speaker Diarization and Recognition with Multimodal Large Language Models Paper • 2508.06372 • Published Aug 8, 2025 • 4