Automatic Speech Recognition
NeMo
PyTorch
English
speech
audio
Transducer
TDT
FastConformer
Conformer
NeMo
hf-asr-leaderboard
Eval Results (legacy)
Eval Results
Instructions to use nvidia/parakeet-tdt_ctc-110m with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- NeMo
How to use nvidia/parakeet-tdt_ctc-110m with NeMo:
import nemo.collections.asr as nemo_asr asr_model = nemo_asr.models.ASRModel.from_pretrained("nvidia/parakeet-tdt_ctc-110m") transcriptions = asr_model.transcribe(["file.wav"]) - Notebooks
- Google Colab
- Kaggle
Model creates duplicate transcriptions
#2
by ceyxasm - opened
import nemo.collections.asr as nemo_asr
import sys
MODEL_PATH = '/home/bubu/attention-tag/customs/asr-onprem/parakeet-tdt_ctc-110m.nemo'
asr_model = nemo_asr.models.ASRModel.restore_from(MODEL_PATH)
transcriptions = asr_model.transcribe([sys.argv[1]])
With a single audio wav file, transcriptions consist of a tuple consisting of two transcriptions which are duplicate of each other.