Automatic Speech Recognition
Transformers
PyTorch
Safetensors
Japanese
wav2vec2
audio
speech
Eval Results (legacy)
Instructions to use vumichien/wav2vec2-large-pitch-recognition with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use vumichien/wav2vec2-large-pitch-recognition with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("automatic-speech-recognition", model="vumichien/wav2vec2-large-pitch-recognition")# Load model directly from transformers import AutoProcessor, AutoModelForCTC processor = AutoProcessor.from_pretrained("vumichien/wav2vec2-large-pitch-recognition") model = AutoModelForCTC.from_pretrained("vumichien/wav2vec2-large-pitch-recognition", device_map="auto") - Notebooks
- Google Colab
- Kaggle
YAML Metadata Error:"datasets[0]" with value "Japanese accent datasets" is not valid. If possible, use a dataset id from https://hf.co/datasets.
Wav2Vec2 Accent Japanese
Fine-tuned facebook/wav2vec2-large-xlsr-53 on Japanese accent dataset When using this model, make sure that your speech input is sampled at 16kHz.
Test Result
WER: 15.82%
- Downloads last month
- 1
Evaluation results
- Test WER on Japanese accent datasetsself-reported15.820