xshubhamx commited on
Commit
69a4348
·
verified ·
1 Parent(s): 336d4a2

Upload folder using huggingface_hub

Browse files
training_checkpoints/checkpoint-3215/model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:8e8f588c3bdcf978814435579ceb8858baafedc49140361ca51474f8d50ab267
3
  size 498652812
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:27cfa9a01965191e18dcf2455bb7a6a7f98b49fa1b779a6d6d0f22980e59962c
3
  size 498652812
training_checkpoints/checkpoint-3215/optimizer.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:dc96b638f6570412860b978b3eb4269b5598a618598945ccb7ced5c5a53dde71
3
  size 997425402
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:4637075a9d4f0a9f4ff4f8f5ac3fb0fd8358d6169fdc25b80b61d4fc4788908f
3
  size 997425402
training_checkpoints/checkpoint-3215/rng_state.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:6116ce1f1aadf3809511462afe030ec142b88f4e384f5f7f899862366f3f8305
3
  size 14244
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5b52a3760ed90e3462f7277e704d2dd1f9d1b7005f189ad49825ce0a3603308b
3
  size 14244
training_checkpoints/checkpoint-3215/scheduler.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:9fff83f0a55076d5b83fdc594323e0c5414f3a86cdc910096d21c1f333e74ee5
3
  size 1064
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:6cf5ea58a6a370f2ffd2025b333a1f3443949fe0f9e0434cf8500c9084225fa0
3
  size 1064
training_checkpoints/checkpoint-3215/trainer_state.json CHANGED
@@ -1,5 +1,5 @@
1
  {
2
- "best_metric": 0.1745447316852942,
3
  "best_model_checkpoint": "roberta-base/checkpoint-3215",
4
  "epoch": 5.0,
5
  "eval_steps": 500,
@@ -10,154 +10,154 @@
10
  "log_history": [
11
  {
12
  "epoch": 0.78,
13
- "grad_norm": 6.534026145935059,
14
  "learning_rate": 4.742871954380509e-05,
15
- "loss": 2.2214,
16
  "step": 500
17
  },
18
  {
19
  "epoch": 1.0,
20
- "eval_accuracy": 0.24554608830364058,
21
- "eval_f1_macro": 0.02628524046434494,
22
- "eval_f1_micro": 0.24554608830364058,
23
- "eval_f1_weighted": 0.09681356964210704,
24
- "eval_loss": 2.1982107162475586,
25
- "eval_macro_fpr": 0.06666666666666667,
26
- "eval_macro_sensitivity": 0.06666666666666667,
27
- "eval_macro_specificity": 0.9333333333333333,
28
- "eval_precision": 0.06029288148121926,
29
- "eval_precision_macro": 0.016369739220242704,
30
- "eval_recall": 0.24554608830364058,
31
- "eval_recall_macro": 0.06666666666666667,
32
- "eval_runtime": 29.4439,
33
- "eval_samples_per_second": 43.846,
34
- "eval_steps_per_second": 5.502,
35
- "eval_weighted_fpr": 0.17997043606799704,
36
- "eval_weighted_sensitivity": 0.24554608830364058,
37
- "eval_weighted_specificity": 0.7544539116963594,
38
  "step": 643
39
  },
40
  {
41
  "epoch": 1.56,
42
- "grad_norm": 6.595059871673584,
43
  "learning_rate": 4.483670295489891e-05,
44
- "loss": 2.1462,
45
  "step": 1000
46
  },
47
  {
48
  "epoch": 2.0,
49
- "eval_accuracy": 0.3361735089078234,
50
- "eval_f1_macro": 0.06552880630375763,
51
- "eval_f1_micro": 0.3361735089078234,
52
- "eval_f1_weighted": 0.2010480796875688,
53
- "eval_loss": 1.9634978771209717,
54
- "eval_macro_fpr": 0.09092506634165738,
55
- "eval_macro_sensitivity": 0.11547020741602194,
56
- "eval_macro_specificity": 0.9457066851291582,
57
- "eval_precision": 0.1591168191834871,
58
- "eval_precision_macro": 0.05308920125936356,
59
- "eval_recall": 0.3361735089078234,
60
- "eval_recall_macro": 0.11547020741602194,
61
- "eval_runtime": 57.2389,
62
- "eval_samples_per_second": 22.555,
63
- "eval_steps_per_second": 2.83,
64
- "eval_weighted_fpr": 0.12361171210154334,
65
- "eval_weighted_sensitivity": 0.3361735089078234,
66
- "eval_weighted_specificity": 0.84942676802955,
67
  "step": 1286
68
  },
69
  {
70
  "epoch": 2.33,
71
- "grad_norm": 41.05898666381836,
72
- "learning_rate": 4.224987039917055e-05,
73
- "loss": 1.995,
74
  "step": 1500
75
  },
76
  {
77
  "epoch": 3.0,
78
- "eval_accuracy": 0.3555383423702556,
79
- "eval_f1_macro": 0.09312335075016234,
80
- "eval_f1_micro": 0.3555383423702556,
81
- "eval_f1_weighted": 0.2541975590745503,
82
- "eval_loss": 1.932247281074524,
83
- "eval_macro_fpr": 0.09537141294157879,
84
- "eval_macro_sensitivity": 0.14351969127084646,
85
- "eval_macro_specificity": 0.9497795632717652,
86
- "eval_precision": 0.23412920314698393,
87
- "eval_precision_macro": 0.09260367628400626,
88
- "eval_recall": 0.3555383423702556,
89
- "eval_recall_macro": 0.14351969127084646,
90
- "eval_runtime": 59.8887,
91
- "eval_samples_per_second": 21.557,
92
- "eval_steps_per_second": 2.705,
93
- "eval_weighted_fpr": 0.11463213006337834,
94
- "eval_weighted_sensitivity": 0.3555383423702556,
95
- "eval_weighted_specificity": 0.8911551067062222,
96
  "step": 1929
97
  },
98
  {
99
  "epoch": 3.11,
100
- "grad_norm": 4.287881851196289,
101
- "learning_rate": 3.96630378434422e-05,
102
- "loss": 2.0064,
103
  "step": 2000
104
  },
105
  {
106
  "epoch": 3.89,
107
- "grad_norm": 5.713494777679443,
108
- "learning_rate": 3.7076205287713846e-05,
109
- "loss": 1.8909,
110
  "step": 2500
111
  },
112
  {
113
  "epoch": 4.0,
114
- "eval_accuracy": 0.3787761425251743,
115
- "eval_f1_macro": 0.14496386130680605,
116
- "eval_f1_micro": 0.3787761425251743,
117
- "eval_f1_weighted": 0.29773714484044667,
118
- "eval_loss": 1.8874640464782715,
119
- "eval_macro_fpr": 0.08706956494211866,
120
- "eval_macro_sensitivity": 0.2191470222337379,
121
- "eval_macro_specificity": 0.9525422186332462,
122
- "eval_precision": 0.28749388015966415,
123
- "eval_precision_macro": 0.12703293957809556,
124
- "eval_recall": 0.3787761425251743,
125
- "eval_recall_macro": 0.2191470222337379,
126
- "eval_runtime": 69.4305,
127
- "eval_samples_per_second": 18.594,
128
- "eval_steps_per_second": 2.333,
129
- "eval_weighted_fpr": 0.10486401673640168,
130
- "eval_weighted_sensitivity": 0.3787761425251743,
131
- "eval_weighted_specificity": 0.9093571369735185,
132
  "step": 2572
133
  },
134
  {
135
  "epoch": 4.67,
136
- "grad_norm": 18.91859245300293,
137
- "learning_rate": 3.4484188698807675e-05,
138
- "loss": 1.7621,
139
  "step": 3000
140
  },
141
  {
142
  "epoch": 5.0,
143
- "eval_accuracy": 0.42835011618900076,
144
- "eval_f1_macro": 0.1745447316852942,
145
- "eval_f1_micro": 0.4283501161890007,
146
- "eval_f1_weighted": 0.3593798293323463,
147
- "eval_loss": 1.7168936729431152,
148
- "eval_macro_fpr": 0.07431772683182448,
149
- "eval_macro_sensitivity": 0.2270221309090987,
150
- "eval_macro_specificity": 0.95583829077833,
151
- "eval_precision": 0.374728097525222,
152
- "eval_precision_macro": 0.18202607308331148,
153
- "eval_recall": 0.42835011618900076,
154
- "eval_recall_macro": 0.2270221309090987,
155
- "eval_runtime": 58.7135,
156
- "eval_samples_per_second": 21.988,
157
- "eval_steps_per_second": 2.759,
158
- "eval_weighted_fpr": 0.08702830188679245,
159
- "eval_weighted_sensitivity": 0.42835011618900076,
160
- "eval_weighted_specificity": 0.9092242454859507,
161
  "step": 3215
162
  }
163
  ],
 
1
  {
2
+ "best_metric": 0.6116525431724917,
3
  "best_model_checkpoint": "roberta-base/checkpoint-3215",
4
  "epoch": 5.0,
5
  "eval_steps": 500,
 
10
  "log_history": [
11
  {
12
  "epoch": 0.78,
13
+ "grad_norm": 16.478424072265625,
14
  "learning_rate": 4.742871954380509e-05,
15
+ "loss": 1.4921,
16
  "step": 500
17
  },
18
  {
19
  "epoch": 1.0,
20
+ "eval_accuracy": 0.6762199845081333,
21
+ "eval_f1_macro": 0.36762215914350266,
22
+ "eval_f1_micro": 0.6762199845081333,
23
+ "eval_f1_weighted": 0.6381553142782734,
24
+ "eval_loss": 1.0307424068450928,
25
+ "eval_macro_fpr": 0.03508857639652692,
26
+ "eval_macro_sensitivity": 0.4027183655220987,
27
+ "eval_macro_specificity": 0.9746655126680946,
28
+ "eval_precision": 0.6361951106730956,
29
+ "eval_precision_macro": 0.3745780279088578,
30
+ "eval_recall": 0.6762199845081333,
31
+ "eval_recall_macro": 0.4027183655220987,
32
+ "eval_runtime": 65.0146,
33
+ "eval_samples_per_second": 19.857,
34
+ "eval_steps_per_second": 2.492,
35
+ "eval_weighted_fpr": 0.03306962025316456,
36
+ "eval_weighted_sensitivity": 0.6762199845081333,
37
+ "eval_weighted_specificity": 0.9437627055132857,
38
  "step": 643
39
  },
40
  {
41
  "epoch": 1.56,
42
+ "grad_norm": 11.052178382873535,
43
  "learning_rate": 4.483670295489891e-05,
44
+ "loss": 0.9019,
45
  "step": 1000
46
  },
47
  {
48
  "epoch": 2.0,
49
+ "eval_accuracy": 0.737412858249419,
50
+ "eval_f1_macro": 0.4767493392755858,
51
+ "eval_f1_micro": 0.737412858249419,
52
+ "eval_f1_weighted": 0.7197263095885438,
53
+ "eval_loss": 0.8135831952095032,
54
+ "eval_macro_fpr": 0.025093207469991694,
55
+ "eval_macro_sensitivity": 0.5148741493607558,
56
+ "eval_macro_specificity": 0.9804978566683986,
57
+ "eval_precision": 0.7158327481302543,
58
+ "eval_precision_macro": 0.4625056436667857,
59
+ "eval_recall": 0.737412858249419,
60
+ "eval_recall_macro": 0.5148741493607558,
61
+ "eval_runtime": 78.3833,
62
+ "eval_samples_per_second": 16.47,
63
+ "eval_steps_per_second": 2.067,
64
+ "eval_weighted_fpr": 0.024804273066510573,
65
+ "eval_weighted_sensitivity": 0.737412858249419,
66
+ "eval_weighted_specificity": 0.9700549917765612,
67
  "step": 1286
68
  },
69
  {
70
  "epoch": 2.33,
71
+ "grad_norm": 16.875791549682617,
72
+ "learning_rate": 4.224468636599274e-05,
73
+ "loss": 0.7714,
74
  "step": 1500
75
  },
76
  {
77
  "epoch": 3.0,
78
+ "eval_accuracy": 0.7621998450813323,
79
+ "eval_f1_macro": 0.5064301619528891,
80
+ "eval_f1_micro": 0.7621998450813323,
81
+ "eval_f1_weighted": 0.7440787580787277,
82
+ "eval_loss": 0.8493772149085999,
83
+ "eval_macro_fpr": 0.022439395825223803,
84
+ "eval_macro_sensitivity": 0.5353612181578932,
85
+ "eval_macro_specificity": 0.9822327546765126,
86
+ "eval_precision": 0.7385639759374297,
87
+ "eval_precision_macro": 0.505572707108006,
88
+ "eval_recall": 0.7621998450813323,
89
+ "eval_recall_macro": 0.5353612181578932,
90
+ "eval_runtime": 62.8149,
91
+ "eval_samples_per_second": 20.552,
92
+ "eval_steps_per_second": 2.579,
93
+ "eval_weighted_fpr": 0.02179933252858056,
94
+ "eval_weighted_sensitivity": 0.7621998450813323,
95
+ "eval_weighted_specificity": 0.9712914750663563,
96
  "step": 1929
97
  },
98
  {
99
  "epoch": 3.11,
100
+ "grad_norm": 59.48842239379883,
101
+ "learning_rate": 3.9652669777086575e-05,
102
+ "loss": 0.7018,
103
  "step": 2000
104
  },
105
  {
106
  "epoch": 3.89,
107
+ "grad_norm": 1.6855363845825195,
108
+ "learning_rate": 3.706583722135822e-05,
109
+ "loss": 0.5351,
110
  "step": 2500
111
  },
112
  {
113
  "epoch": 4.0,
114
+ "eval_accuracy": 0.7645236250968241,
115
+ "eval_f1_macro": 0.544445143585482,
116
+ "eval_f1_micro": 0.7645236250968241,
117
+ "eval_f1_weighted": 0.7545581478665218,
118
+ "eval_loss": 0.9904704093933105,
119
+ "eval_macro_fpr": 0.022368675533492623,
120
+ "eval_macro_sensitivity": 0.5653277909563001,
121
+ "eval_macro_specificity": 0.9821237739107975,
122
+ "eval_precision": 0.7656722240785093,
123
+ "eval_precision_macro": 0.5495765557734748,
124
+ "eval_recall": 0.7645236250968241,
125
+ "eval_recall_macro": 0.5653277909563001,
126
+ "eval_runtime": 80.7211,
127
+ "eval_samples_per_second": 15.993,
128
+ "eval_steps_per_second": 2.007,
129
+ "eval_weighted_fpr": 0.021526695935419914,
130
+ "eval_weighted_sensitivity": 0.7645236250968241,
131
+ "eval_weighted_specificity": 0.9673329835651372,
132
  "step": 2572
133
  },
134
  {
135
  "epoch": 4.67,
136
+ "grad_norm": 41.18514633178711,
137
+ "learning_rate": 3.447382063245205e-05,
138
+ "loss": 0.4521,
139
  "step": 3000
140
  },
141
  {
142
  "epoch": 5.0,
143
+ "eval_accuracy": 0.7900852052672347,
144
+ "eval_f1_macro": 0.6116525431724917,
145
+ "eval_f1_micro": 0.7900852052672347,
146
+ "eval_f1_weighted": 0.7794301250682801,
147
+ "eval_loss": 1.0259578227996826,
148
+ "eval_macro_fpr": 0.019043445988564375,
149
+ "eval_macro_sensitivity": 0.6315170743424566,
150
+ "eval_macro_specificity": 0.984305159354804,
151
+ "eval_precision": 0.7882093327742286,
152
+ "eval_precision_macro": 0.6420940275483907,
153
+ "eval_recall": 0.7900852052672347,
154
+ "eval_recall_macro": 0.6315170743424566,
155
+ "eval_runtime": 56.9964,
156
+ "eval_samples_per_second": 22.651,
157
+ "eval_steps_per_second": 2.842,
158
+ "eval_weighted_fpr": 0.018624149542986735,
159
+ "eval_weighted_sensitivity": 0.7900852052672347,
160
+ "eval_weighted_specificity": 0.9744921850548264,
161
  "step": 3215
162
  }
163
  ],
training_checkpoints/checkpoint-3215/training_args.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:6da235c4e1e89b590bb6c4dd543edc36c67b04a23baad1858c6c64a331ed4bd1
3
  size 4920
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:beb8f128167a5d05587c32e6e3bff806f690d3ab0996792b1d08193bcb3299f2
3
  size 4920