EYEDOL commited on
Commit
bc5e698
·
verified ·
1 Parent(s): fb8136d

Training in progress, epoch 1

Browse files
config.json ADDED
@@ -0,0 +1,59 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "activation_dropout": 0.0,
3
+ "activation_function": "gelu",
4
+ "apply_spec_augment": false,
5
+ "architectures": [
6
+ "WhisperForConditionalGeneration"
7
+ ],
8
+ "attention_dropout": 0.0,
9
+ "bos_token_id": 8000,
10
+ "classifier_proj_size": 256,
11
+ "d_model": 384,
12
+ "decoder_attention_heads": 6,
13
+ "decoder_ffn_dim": 1536,
14
+ "decoder_layerdrop": 0.0,
15
+ "decoder_layers": 4,
16
+ "decoder_start_token_id": 8001,
17
+ "dropout": 0.0,
18
+ "dtype": "float32",
19
+ "encoder_attention_heads": 6,
20
+ "encoder_ffn_dim": 1536,
21
+ "encoder_layerdrop": 0.0,
22
+ "encoder_layers": 4,
23
+ "eos_token_id": 8000,
24
+ "forced_decoder_ids": [
25
+ [
26
+ 1,
27
+ 50259
28
+ ],
29
+ [
30
+ 2,
31
+ 50359
32
+ ],
33
+ [
34
+ 3,
35
+ 50363
36
+ ]
37
+ ],
38
+ "init_std": 0.02,
39
+ "is_encoder_decoder": true,
40
+ "mask_feature_length": 10,
41
+ "mask_feature_min_masks": 0,
42
+ "mask_feature_prob": 0.0,
43
+ "mask_time_length": 10,
44
+ "mask_time_min_masks": 2,
45
+ "mask_time_prob": 0.05,
46
+ "max_source_positions": 1500,
47
+ "max_target_positions": 448,
48
+ "median_filter_width": 7,
49
+ "model_type": "whisper",
50
+ "num_hidden_layers": 4,
51
+ "num_mel_bins": 80,
52
+ "pad_token_id": 8000,
53
+ "scale_embedding": false,
54
+ "tie_word_embeddings": true,
55
+ "transformers_version": "5.0.0",
56
+ "use_cache": false,
57
+ "use_weighted_layer_sum": false,
58
+ "vocab_size": 8107
59
+ }
generation_config.json ADDED
@@ -0,0 +1,192 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "alignment_heads": [
3
+ [
4
+ 2,
5
+ 2
6
+ ],
7
+ [
8
+ 3,
9
+ 0
10
+ ],
11
+ [
12
+ 3,
13
+ 2
14
+ ],
15
+ [
16
+ 3,
17
+ 3
18
+ ],
19
+ [
20
+ 3,
21
+ 4
22
+ ],
23
+ [
24
+ 3,
25
+ 5
26
+ ]
27
+ ],
28
+ "assistant_confidence_threshold": 0.4,
29
+ "assistant_lookbehind": 10,
30
+ "begin_suppress_tokens": [],
31
+ "bos_token_id": 8000,
32
+ "decoder_start_token_id": 8001,
33
+ "diversity_penalty": 0.0,
34
+ "do_sample": false,
35
+ "early_stopping": false,
36
+ "encoder_no_repeat_ngram_size": 0,
37
+ "encoder_repetition_penalty": 1.0,
38
+ "eos_token_id": [
39
+ 8000,
40
+ 50257
41
+ ],
42
+ "epsilon_cutoff": 0.0,
43
+ "eta_cutoff": 0.0,
44
+ "forced_decoder_ids": [
45
+ [
46
+ 1,
47
+ 8068
48
+ ],
49
+ [
50
+ 2,
51
+ 8102
52
+ ],
53
+ [
54
+ 3,
55
+ 8106
56
+ ]
57
+ ],
58
+ "is_multilingual": true,
59
+ "lang_to_id": {
60
+ "<|af|>": 8070,
61
+ "<|am|>": 8077,
62
+ "<|ar|>": 8015,
63
+ "<|as|>": 8093,
64
+ "<|az|>": 8047,
65
+ "<|ba|>": 8098,
66
+ "<|be|>": 8073,
67
+ "<|bg|>": 8035,
68
+ "<|bn|>": 8045,
69
+ "<|bo|>": 8090,
70
+ "<|br|>": 8052,
71
+ "<|bs|>": 8058,
72
+ "<|ca|>": 8013,
73
+ "<|cs|>": 8026,
74
+ "<|cy|>": 8040,
75
+ "<|da|>": 8028,
76
+ "<|de|>": 8004,
77
+ "<|el|>": 8024,
78
+ "<|en|>": 8002,
79
+ "<|es|>": 8005,
80
+ "<|et|>": 8050,
81
+ "<|eu|>": 8053,
82
+ "<|fa|>": 8043,
83
+ "<|fi|>": 8020,
84
+ "<|fo|>": 8081,
85
+ "<|fr|>": 8008,
86
+ "<|gl|>": 8062,
87
+ "<|gu|>": 8076,
88
+ "<|haw|>": 8095,
89
+ "<|ha|>": 8097,
90
+ "<|he|>": 8022,
91
+ "<|hi|>": 8019,
92
+ "<|hr|>": 8034,
93
+ "<|ht|>": 8082,
94
+ "<|hu|>": 8029,
95
+ "<|hy|>": 8055,
96
+ "<|id|>": 8018,
97
+ "<|is|>": 8054,
98
+ "<|it|>": 8017,
99
+ "<|ja|>": 8009,
100
+ "<|jw|>": 8099,
101
+ "<|ka|>": 8072,
102
+ "<|kk|>": 8059,
103
+ "<|km|>": 8066,
104
+ "<|kn|>": 8049,
105
+ "<|ko|>": 8007,
106
+ "<|la|>": 8037,
107
+ "<|lb|>": 8088,
108
+ "<|ln|>": 8096,
109
+ "<|lo|>": 8079,
110
+ "<|lt|>": 8036,
111
+ "<|lv|>": 8044,
112
+ "<|mg|>": 8092,
113
+ "<|mi|>": 8038,
114
+ "<|mk|>": 8051,
115
+ "<|ml|>": 8039,
116
+ "<|mn|>": 8057,
117
+ "<|mr|>": 8063,
118
+ "<|ms|>": 8025,
119
+ "<|mt|>": 8086,
120
+ "<|my|>": 8089,
121
+ "<|ne|>": 8056,
122
+ "<|nl|>": 8014,
123
+ "<|nn|>": 8085,
124
+ "<|no|>": 8031,
125
+ "<|oc|>": 8071,
126
+ "<|pa|>": 8064,
127
+ "<|pl|>": 8012,
128
+ "<|ps|>": 8083,
129
+ "<|pt|>": 8010,
130
+ "<|ro|>": 8027,
131
+ "<|ru|>": 8006,
132
+ "<|sa|>": 8087,
133
+ "<|sd|>": 8075,
134
+ "<|si|>": 8065,
135
+ "<|sk|>": 8041,
136
+ "<|sl|>": 8048,
137
+ "<|sn|>": 8067,
138
+ "<|so|>": 8069,
139
+ "<|sq|>": 8060,
140
+ "<|sr|>": 8046,
141
+ "<|su|>": 8100,
142
+ "<|sv|>": 8016,
143
+ "<|sw|>": 8061,
144
+ "<|ta|>": 8030,
145
+ "<|te|>": 8042,
146
+ "<|tg|>": 8074,
147
+ "<|th|>": 8032,
148
+ "<|tk|>": 8084,
149
+ "<|tl|>": 8091,
150
+ "<|tr|>": 8011,
151
+ "<|tt|>": 8094,
152
+ "<|uk|>": 8023,
153
+ "<|ur|>": 8033,
154
+ "<|uz|>": 8080,
155
+ "<|vi|>": 8021,
156
+ "<|yi|>": 8078,
157
+ "<|yo|>": 8068,
158
+ "<|zh|>": 8003
159
+ },
160
+ "language": "yoruba",
161
+ "length_penalty": 1.0,
162
+ "max_initial_timestamp_index": 50,
163
+ "max_length": 448,
164
+ "min_length": 0,
165
+ "no_repeat_ngram_size": 0,
166
+ "no_timestamps_token_id": 8106,
167
+ "num_assistant_tokens": 20,
168
+ "num_assistant_tokens_schedule": "constant",
169
+ "num_beam_groups": 1,
170
+ "num_beams": 1,
171
+ "num_return_sequences": 1,
172
+ "output_scores": false,
173
+ "pad_token_id": 8000,
174
+ "prev_sot_token_id": 50361,
175
+ "remove_invalid_values": false,
176
+ "repetition_penalty": 1.0,
177
+ "return_dict_in_generate": false,
178
+ "return_timestamps": false,
179
+ "suppress_tokens": [],
180
+ "target_lookbehind": 10,
181
+ "task": "transcribe",
182
+ "task_to_id": {
183
+ "transcribe": 8000,
184
+ "translate": 8000
185
+ },
186
+ "temperature": 1.0,
187
+ "top_k": 50,
188
+ "top_p": 1.0,
189
+ "transformers_version": "5.0.0",
190
+ "typical_p": 1.0,
191
+ "use_cache": true
192
+ }
model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:b7069a0892172186b327acecb4a704bc2957cfe8145b673b05555a307eade22c
3
+ size 83849160
processor_config.json ADDED
@@ -0,0 +1,17 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "feature_extractor": {
3
+ "chunk_length": 30,
4
+ "dither": 0.0,
5
+ "feature_extractor_type": "WhisperFeatureExtractor",
6
+ "feature_size": 80,
7
+ "hop_length": 160,
8
+ "n_fft": 400,
9
+ "n_samples": 480000,
10
+ "nb_max_frames": 3000,
11
+ "padding_side": "right",
12
+ "padding_value": 0.0,
13
+ "return_attention_mask": false,
14
+ "sampling_rate": 16000
15
+ },
16
+ "processor_class": "WhisperProcessor"
17
+ }
tokenizer.json ADDED
The diff for this file is too large to render. See raw diff
 
tokenizer_config.json ADDED
@@ -0,0 +1,122 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "add_prefix_space": false,
3
+ "backend": "tokenizers",
4
+ "bos_token": "<|endoftext|>",
5
+ "eos_token": "<|endoftext|>",
6
+ "extra_special_tokens": [
7
+ "<|startoftranscript|>",
8
+ "<|en|>",
9
+ "<|zh|>",
10
+ "<|de|>",
11
+ "<|es|>",
12
+ "<|ru|>",
13
+ "<|ko|>",
14
+ "<|fr|>",
15
+ "<|ja|>",
16
+ "<|pt|>",
17
+ "<|tr|>",
18
+ "<|pl|>",
19
+ "<|ca|>",
20
+ "<|nl|>",
21
+ "<|ar|>",
22
+ "<|sv|>",
23
+ "<|it|>",
24
+ "<|id|>",
25
+ "<|hi|>",
26
+ "<|fi|>",
27
+ "<|vi|>",
28
+ "<|he|>",
29
+ "<|uk|>",
30
+ "<|el|>",
31
+ "<|ms|>",
32
+ "<|cs|>",
33
+ "<|ro|>",
34
+ "<|da|>",
35
+ "<|hu|>",
36
+ "<|ta|>",
37
+ "<|no|>",
38
+ "<|th|>",
39
+ "<|ur|>",
40
+ "<|hr|>",
41
+ "<|bg|>",
42
+ "<|lt|>",
43
+ "<|la|>",
44
+ "<|mi|>",
45
+ "<|ml|>",
46
+ "<|cy|>",
47
+ "<|sk|>",
48
+ "<|te|>",
49
+ "<|fa|>",
50
+ "<|lv|>",
51
+ "<|bn|>",
52
+ "<|sr|>",
53
+ "<|az|>",
54
+ "<|sl|>",
55
+ "<|kn|>",
56
+ "<|et|>",
57
+ "<|mk|>",
58
+ "<|br|>",
59
+ "<|eu|>",
60
+ "<|is|>",
61
+ "<|hy|>",
62
+ "<|ne|>",
63
+ "<|mn|>",
64
+ "<|bs|>",
65
+ "<|kk|>",
66
+ "<|sq|>",
67
+ "<|sw|>",
68
+ "<|gl|>",
69
+ "<|mr|>",
70
+ "<|pa|>",
71
+ "<|si|>",
72
+ "<|km|>",
73
+ "<|sn|>",
74
+ "<|yo|>",
75
+ "<|so|>",
76
+ "<|af|>",
77
+ "<|oc|>",
78
+ "<|ka|>",
79
+ "<|be|>",
80
+ "<|tg|>",
81
+ "<|sd|>",
82
+ "<|gu|>",
83
+ "<|am|>",
84
+ "<|yi|>",
85
+ "<|lo|>",
86
+ "<|uz|>",
87
+ "<|fo|>",
88
+ "<|ht|>",
89
+ "<|ps|>",
90
+ "<|tk|>",
91
+ "<|nn|>",
92
+ "<|mt|>",
93
+ "<|sa|>",
94
+ "<|lb|>",
95
+ "<|my|>",
96
+ "<|bo|>",
97
+ "<|tl|>",
98
+ "<|mg|>",
99
+ "<|as|>",
100
+ "<|tt|>",
101
+ "<|haw|>",
102
+ "<|ln|>",
103
+ "<|ha|>",
104
+ "<|ba|>",
105
+ "<|jw|>",
106
+ "<|su|>",
107
+ "<|translate|>",
108
+ "<|transcribe|>",
109
+ "<|startoflm|>",
110
+ "<|startofprev|>",
111
+ "<|nocaptions|>",
112
+ "<|notimestamps|>"
113
+ ],
114
+ "language": "yoruba",
115
+ "model_max_length": 1000000000000000019884624838656,
116
+ "pad_token": "<|endoftext|>",
117
+ "predict_timestamps": false,
118
+ "processor_class": "WhisperProcessor",
119
+ "task": "transcribe",
120
+ "tokenizer_class": "WhisperTokenizer",
121
+ "unk_token": "<|endoftext|>"
122
+ }
training_args.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:689aecae5d6e68c6ddd7f0354ea17c2dcc9e19b7c2c769aadf2000330b2dd8c2
3
+ size 5393