ilyali034 commited on
Commit
fbdfdfd
·
verified ·
1 Parent(s): 3458bbc

Delete checkpoint-942

Browse files
checkpoint-942/config.json DELETED
@@ -1,46 +0,0 @@
1
- {
2
- "add_cross_attention": false,
3
- "architectures": [
4
- "BertForSequenceClassification"
5
- ],
6
- "attention_probs_dropout_prob": 0.1,
7
- "bos_token_id": null,
8
- "classifier_dropout": null,
9
- "dtype": "float32",
10
- "emb_size": 312,
11
- "eos_token_id": null,
12
- "gradient_checkpointing": false,
13
- "hidden_act": "gelu",
14
- "hidden_dropout_prob": 0.1,
15
- "hidden_size": 312,
16
- "id2label": {
17
- "0": "joy",
18
- "1": "sadness",
19
- "2": "surprise",
20
- "3": "fear",
21
- "4": "anger"
22
- },
23
- "initializer_range": 0.02,
24
- "intermediate_size": 600,
25
- "is_decoder": false,
26
- "label2id": {
27
- "anger": 4,
28
- "fear": 3,
29
- "joy": 0,
30
- "sadness": 1,
31
- "surprise": 2
32
- },
33
- "layer_norm_eps": 1e-12,
34
- "max_position_embeddings": 2048,
35
- "model_type": "bert",
36
- "num_attention_heads": 12,
37
- "num_hidden_layers": 3,
38
- "pad_token_id": 0,
39
- "position_embedding_type": "absolute",
40
- "problem_type": "multi_label_classification",
41
- "tie_word_embeddings": true,
42
- "transformers_version": "5.0.0",
43
- "type_vocab_size": 2,
44
- "use_cache": false,
45
- "vocab_size": 83828
46
- }
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
checkpoint-942/model.safetensors DELETED
@@ -1,3 +0,0 @@
1
- version https://git-lfs.github.com/spec/v1
2
- oid sha256:b69424d2f2fe85b36add081e4cd611c1987a51b5ac61f299ef736a378616cc7c
3
- size 116787884
 
 
 
 
checkpoint-942/optimizer.pt DELETED
@@ -1,3 +0,0 @@
1
- version https://git-lfs.github.com/spec/v1
2
- oid sha256:d6bcc7b17bcf6909d032744cadd62fd97a5cc6ce229fdee06411d10cbb85beb4
3
- size 233609739
 
 
 
 
checkpoint-942/rng_state.pth DELETED
@@ -1,3 +0,0 @@
1
- version https://git-lfs.github.com/spec/v1
2
- oid sha256:73508fc87ada6ef68a2efa76a568d2766c1df87038408aaca4cc2cb60fe9ca11
3
- size 14645
 
 
 
 
checkpoint-942/scaler.pt DELETED
@@ -1,3 +0,0 @@
1
- version https://git-lfs.github.com/spec/v1
2
- oid sha256:d6b89a66a1078d730a6a41d69d28582577df657a20eef3b4b5a556491ecfa2f2
3
- size 1383
 
 
 
 
checkpoint-942/scheduler.pt DELETED
@@ -1,3 +0,0 @@
1
- version https://git-lfs.github.com/spec/v1
2
- oid sha256:e9540252dfe0d7c93abe2b7e3fab8b7687142832e7125c70867af11621a99694
3
- size 1465
 
 
 
 
checkpoint-942/tokenizer.json DELETED
The diff for this file is too large to render. See raw diff
 
checkpoint-942/tokenizer_config.json DELETED
@@ -1,16 +0,0 @@
1
- {
2
- "backend": "tokenizers",
3
- "cls_token": "[CLS]",
4
- "do_basic_tokenize": true,
5
- "do_lower_case": false,
6
- "is_local": false,
7
- "mask_token": "[MASK]",
8
- "model_max_length": 2048,
9
- "never_split": null,
10
- "pad_token": "[PAD]",
11
- "sep_token": "[SEP]",
12
- "strip_accents": null,
13
- "tokenize_chinese_chars": true,
14
- "tokenizer_class": "BertTokenizer",
15
- "unk_token": "[UNK]"
16
- }
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
checkpoint-942/trainer_state.json DELETED
@@ -1,212 +0,0 @@
1
- {
2
- "best_global_step": 942,
3
- "best_metric": 0.6239972778341636,
4
- "best_model_checkpoint": "./emotion-model/checkpoint-942",
5
- "epoch": 2.0,
6
- "eval_steps": 500,
7
- "global_step": 942,
8
- "is_hyper_param_search": false,
9
- "is_local_process_zero": true,
10
- "is_world_process_zero": true,
11
- "log_history": [
12
- {
13
- "epoch": 0.0021231422505307855,
14
- "grad_norm": 1.0219730138778687,
15
- "learning_rate": 0.0,
16
- "loss": 1.3030585050582886,
17
- "step": 1
18
- },
19
- {
20
- "epoch": 0.10615711252653928,
21
- "grad_norm": 1.0375804901123047,
22
- "learning_rate": 4.9000000000000005e-06,
23
- "loss": 1.2025704675791216,
24
- "step": 50
25
- },
26
- {
27
- "epoch": 0.21231422505307856,
28
- "grad_norm": 1.135884165763855,
29
- "learning_rate": 9.9e-06,
30
- "loss": 1.2190129089355468,
31
- "step": 100
32
- },
33
- {
34
- "epoch": 0.3184713375796178,
35
- "grad_norm": 2.0595483779907227,
36
- "learning_rate": 1.4900000000000001e-05,
37
- "loss": 1.2196697998046875,
38
- "step": 150
39
- },
40
- {
41
- "epoch": 0.42462845010615713,
42
- "grad_norm": 1.5242352485656738,
43
- "learning_rate": 1.9900000000000003e-05,
44
- "loss": 1.151480484008789,
45
- "step": 200
46
- },
47
- {
48
- "epoch": 0.5307855626326964,
49
- "grad_norm": 1.564010500907898,
50
- "learning_rate": 1.9987649342401833e-05,
51
- "loss": 1.1144582366943359,
52
- "step": 250
53
- },
54
- {
55
- "epoch": 0.6369426751592356,
56
- "grad_norm": 1.9027994871139526,
57
- "learning_rate": 1.9949615993505947e-05,
58
- "loss": 1.0536087799072265,
59
- "step": 300
60
- },
61
- {
62
- "epoch": 0.7430997876857749,
63
- "grad_norm": 1.6534069776535034,
64
- "learning_rate": 1.9885992628548134e-05,
65
- "loss": 0.9932283782958984,
66
- "step": 350
67
- },
68
- {
69
- "epoch": 0.8492569002123143,
70
- "grad_norm": 2.1589057445526123,
71
- "learning_rate": 1.979694288428907e-05,
72
- "loss": 0.9436125183105468,
73
- "step": 400
74
- },
75
- {
76
- "epoch": 0.9554140127388535,
77
- "grad_norm": 3.7647249698638916,
78
- "learning_rate": 1.968269579312432e-05,
79
- "loss": 0.901458740234375,
80
- "step": 450
81
- },
82
- {
83
- "epoch": 1.0,
84
- "eval_f1_anger": 0.2402088772845953,
85
- "eval_f1_fear": 0.39570552147239263,
86
- "eval_f1_joy": 0.6474226804123712,
87
- "eval_f1_macro": 0.48621739592148633,
88
- "eval_f1_micro": 0.5074478649453823,
89
- "eval_f1_sadness": 0.6693548387096774,
90
- "eval_f1_surprise": 0.4783950617283951,
91
- "eval_f1_weighted": 0.5559704098788901,
92
- "eval_loss": 0.8404765725135803,
93
- "eval_precision_micro": 0.35734265734265735,
94
- "eval_recall_micro": 0.875,
95
- "eval_runtime": 0.8017,
96
- "eval_samples_per_second": 2347.426,
97
- "eval_steps_per_second": 73.591,
98
- "step": 471
99
- },
100
- {
101
- "epoch": 1.0615711252653928,
102
- "grad_norm": 2.039538621902466,
103
- "learning_rate": 1.9543545194022126e-05,
104
- "loss": 0.8428041839599609,
105
- "step": 500
106
- },
107
- {
108
- "epoch": 1.167728237791932,
109
- "grad_norm": 1.9058315753936768,
110
- "learning_rate": 1.9379848976781286e-05,
111
- "loss": 0.8053652954101562,
112
- "step": 550
113
- },
114
- {
115
- "epoch": 1.2738853503184713,
116
- "grad_norm": 4.43000602722168,
117
- "learning_rate": 1.9192028161552848e-05,
118
- "loss": 0.7638420867919922,
119
- "step": 600
120
- },
121
- {
122
- "epoch": 1.3800424628450108,
123
- "grad_norm": 4.02421760559082,
124
- "learning_rate": 1.8980565815993052e-05,
125
- "loss": 0.7467809295654297,
126
- "step": 650
127
- },
128
- {
129
- "epoch": 1.48619957537155,
130
- "grad_norm": 3.824873447418213,
131
- "learning_rate": 1.8746005812832556e-05,
132
- "loss": 0.7299433135986328,
133
- "step": 700
134
- },
135
- {
136
- "epoch": 1.5923566878980893,
137
- "grad_norm": 4.278666019439697,
138
- "learning_rate": 1.848895143105743e-05,
139
- "loss": 0.7085485076904297,
140
- "step": 750
141
- },
142
- {
143
- "epoch": 1.6985138004246285,
144
- "grad_norm": 8.145888328552246,
145
- "learning_rate": 1.8210063804299633e-05,
146
- "loss": 0.6738013458251954,
147
- "step": 800
148
- },
149
- {
150
- "epoch": 1.8046709129511678,
151
- "grad_norm": 2.671503782272339,
152
- "learning_rate": 1.7910060220427653e-05,
153
- "loss": 0.6593016052246093,
154
- "step": 850
155
- },
156
- {
157
- "epoch": 1.910828025477707,
158
- "grad_norm": 2.6236929893493652,
159
- "learning_rate": 1.7589712276710663e-05,
160
- "loss": 0.6721290588378906,
161
- "step": 900
162
- },
163
- {
164
- "epoch": 2.0,
165
- "eval_f1_anger": 0.35555555555555557,
166
- "eval_f1_fear": 0.5619469026548672,
167
- "eval_f1_joy": 0.8010139416983524,
168
- "eval_f1_macro": 0.6239972778341636,
169
- "eval_f1_micro": 0.6600384862091084,
170
- "eval_f1_sadness": 0.7654867256637168,
171
- "eval_f1_surprise": 0.6359832635983264,
172
- "eval_f1_weighted": 0.6889327936443179,
173
- "eval_loss": 0.653545618057251,
174
- "eval_precision_micro": 0.5276923076923077,
175
- "eval_recall_micro": 0.8809931506849316,
176
- "eval_runtime": 1.0667,
177
- "eval_samples_per_second": 1764.333,
178
- "eval_steps_per_second": 55.311,
179
- "step": 942
180
- }
181
- ],
182
- "logging_steps": 50,
183
- "max_steps": 3297,
184
- "num_input_tokens_seen": 0,
185
- "num_train_epochs": 7,
186
- "save_steps": 500,
187
- "stateful_callbacks": {
188
- "EarlyStoppingCallback": {
189
- "args": {
190
- "early_stopping_patience": 3,
191
- "early_stopping_threshold": 0.0
192
- },
193
- "attributes": {
194
- "early_stopping_patience_counter": 0
195
- }
196
- },
197
- "TrainerControl": {
198
- "args": {
199
- "should_epoch_stop": false,
200
- "should_evaluate": false,
201
- "should_log": false,
202
- "should_save": true,
203
- "should_training_stop": false
204
- },
205
- "attributes": {}
206
- }
207
- },
208
- "total_flos": 9385158966576.0,
209
- "train_batch_size": 16,
210
- "trial_name": null,
211
- "trial_params": null
212
- }
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
checkpoint-942/training_args.bin DELETED
@@ -1,3 +0,0 @@
1
- version https://git-lfs.github.com/spec/v1
2
- oid sha256:4732f78bc22032e10354e9784643def497ab4c7dbec47fb98f94810b54390c71
3
- size 5201