MLSpeech commited on
Commit
c180a61
·
verified ·
1 Parent(s): 37634ed

Added evaluation results

Browse files
Files changed (1) hide show
  1. README.md +118 -19
README.md CHANGED
@@ -1,30 +1,129 @@
1
  ---
2
  license: mit
3
  datasets:
4
- - openslr/librispeech_asr
5
- - facebook/multilingual_librispeech
6
  language:
7
- - en
8
- - fr
9
- - de
10
- - pt
11
- - es
12
  metrics:
13
- - wer
14
  base_model:
15
- - openai/whisper-base
16
- - openai/whisper-small
17
- - openai/whisper-large-v2
18
  pipeline_tag: automatic-speech-recognition
19
  tags:
20
- - streaming
21
- - asr
22
- - Transformer
23
- - encoder-decoder
24
- - pytorch
25
- - audio
26
- - speech
27
- - Whisper
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
28
  ---
29
  # CarelessWhisper - Causal Whisper Streaming Model
30
  Causal Whisper Streaming is a fine tuned version of OpenAI Whisper, which can handle causal data and perform real-time transcription.
 
1
  ---
2
  license: mit
3
  datasets:
4
+ - openslr/librispeech_asr
5
+ - facebook/multilingual_librispeech
6
  language:
7
+ - en
8
+ - fr
9
+ - de
10
+ - pt
11
+ - es
12
  metrics:
13
+ - wer
14
  base_model:
15
+ - openai/whisper-base
16
+ - openai/whisper-small
17
+ - openai/whisper-large-v2
18
  pipeline_tag: automatic-speech-recognition
19
  tags:
20
+ - streaming
21
+ - asr
22
+ - Transformer
23
+ - encoder-decoder
24
+ - pytorch
25
+ - audio
26
+ - speech
27
+ - Whisper
28
+ model-index:
29
+ - name: CarelessWhisper-large-v2
30
+ results:
31
+ - task:
32
+ type: streaming-transcription-chunk-300msec
33
+ dataset:
34
+ name: LibriSpeech
35
+ type: test-clean
36
+ metrics:
37
+ - name: Word Error Rate (WER) [%]
38
+ type: Word Error Rate (WER) [%]
39
+ value: 5.29
40
+ - name: Aligned-Relative Word Error Rate (ARWER) [%]
41
+ type: Aligned-Relative Word Error Rate (WER) [%]
42
+ value: 6.00
43
+ - task:
44
+ type: streaming-transcription-chunk-300msec
45
+ dataset:
46
+ name: LibriSpeech
47
+ type: test-other
48
+ metrics:
49
+ - name: Word Error Rate (WER) [%]
50
+ type: Word Error Rate (WER) [%]
51
+ value: 10.74
52
+ - name: Aligned-Relative Word Error Rate (ARWER) [%]
53
+ type: Aligned-Relative Word Error Rate (WER) [%]
54
+ value: 11.38
55
+ - task:
56
+ type: streaming-transcription-chunk-200msec
57
+ dataset:
58
+ name: LibriSpeech
59
+ type: test-clean
60
+ metrics:
61
+ - name: Word Error Rate (WER) [%]
62
+ type: Word Error Rate (WER) [%]
63
+ value: 5.92
64
+ - name: Aligned-Relative Word Error Rate (ARWER) [%]
65
+ type: Aligned-Relative Word Error Rate (WER) [%]
66
+ value: 6.63
67
+ - task:
68
+ type: streaming-transcription-chunk-200msec
69
+ dataset:
70
+ name: LibriSpeech
71
+ type: test-other
72
+ metrics:
73
+ - name: Word Error Rate (WER) [%]
74
+ type: Word Error Rate (WER) [%]
75
+ value: 11.41
76
+ - name: Aligned-Relative Word Error Rate (ARWER) [%]
77
+ type: Aligned-Relative Word Error Rate (WER) [%]
78
+ value: 12.60
79
+ - task:
80
+ type: streaming-transcription-chunk-100msec
81
+ dataset:
82
+ name: LibriSpeech
83
+ type: test-clean
84
+ metrics:
85
+ - name: Word Error Rate (WER) [%]
86
+ type: Word Error Rate (WER) [%]
87
+ value: 6.33
88
+ - name: Aligned-Relative Word Error Rate (ARWER) [%]
89
+ type: Aligned-Relative Word Error Rate (WER) [%]
90
+ value: 7.76
91
+ - task:
92
+ type: streaming-transcription-chunk-100msec
93
+ dataset:
94
+ name: LibriSpeech
95
+ type: test-other
96
+ metrics:
97
+ - name: Word Error Rate (WER) [%]
98
+ type: Word Error Rate (WER) [%]
99
+ value: 13.06
100
+ - name: Aligned-Relative Word Error Rate (ARWER) [%]
101
+ type: Aligned-Relative Word Error Rate (WER) [%]
102
+ value: 14.99
103
+ - task:
104
+ type: streaming-transcription-chunk-40msec
105
+ dataset:
106
+ name: LibriSpeech
107
+ type: test-clean
108
+ metrics:
109
+ - name: Word Error Rate (WER) [%]
110
+ type: Word Error Rate (WER) [%]
111
+ value: 7.76
112
+ - name: Aligned-Relative Word Error Rate (ARWER) [%]
113
+ type: Aligned-Relative Word Error Rate (WER) [%]
114
+ value: 9.94
115
+ - task:
116
+ type: streaming-transcription-chunk-40msec
117
+ dataset:
118
+ name: LibriSpeech
119
+ type: test-other
120
+ metrics:
121
+ - name: Word Error Rate (WER) [%]
122
+ type: Word Error Rate (WER) [%]
123
+ value: 16.73
124
+ - name: Aligned-Relative Word Error Rate (ARWER) [%]
125
+ type: Aligned-Relative Word Error Rate (WER) [%]
126
+ value: 19.28
127
  ---
128
  # CarelessWhisper - Causal Whisper Streaming Model
129
  Causal Whisper Streaming is a fine tuned version of OpenAI Whisper, which can handle causal data and perform real-time transcription.