Speech AI models for Apple Silicon via MLX. ASR, TTS, VAD, diarization, speaker embedding.
-
aufklarer/Silero-VAD-v5-MLX
Voice Activity Detection ⢠309k ⢠Updated ⢠28.7k ⢠3 -
aufklarer/WeSpeaker-ResNet34-LM-MLX
Audio Classification ⢠6.63M ⢠Updated ⢠19.2k ⢠4 -
aufklarer/Silero-VAD-v6.2.1-MLX
Audio Classification ⢠309k ⢠Updated ⢠13.9k ⢠1 -
aufklarer/Qwen3-ForcedAligner-0.6B-4bit
Audio Classification ⢠0.4B ⢠Updated ⢠5.17k ⢠1