Qwen3 Voice Embedding Collection Standalone ECAPA-TDNN x-vector speaker encoders extracted from Qwen3-TTS. 1024-dim (0.6B) and 2048-dim (1.7B). • 4 items • Updated Feb 27 • 29
Running Agents Featured 105 MOSS Transcribe Diarize 🏢 105 Transcribe audio/video with speaker diarization
nvidia/diar_streaming_sortformer_4spk-v2 Automatic Speech Recognition • 0.1B • Updated 10 days ago • 33.8k • 145