xshubhamx commited on
Commit
3e1f1bb
·
verified ·
1 Parent(s): cc07dea

Upload folder using huggingface_hub

Browse files
training_checkpoints/checkpoint-2572/model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:93d9c2cbbb24256937c959c3664e210ae1e2e4fa9b8e7b1fa9e9445d2653dcf2
3
  size 498652812
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d95af8074cc971fb6c23ecc1511bf1b9b21b45aa5df5575a187b84c28670ca6e
3
  size 498652812
training_checkpoints/checkpoint-2572/optimizer.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:5df5400ab439a281f15f6aebc703d1f4668e94f31de2dc314862f8fa26fbf8fe
3
  size 997425402
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:6d592eaee987723e13c4d9be2f1d1433eda3e5b8d1d4479731698997bc3af11a
3
  size 997425402
training_checkpoints/checkpoint-2572/rng_state.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:867d7aaa26f6e3569b6f9003dc4fee43956d36e10904f324cad06a3fbad98a66
3
  size 14244
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:cfd5c7601ae95c77678dbcdbd11b24c0eaf41435cecfc1a415c0e302934a1790
3
  size 14244
training_checkpoints/checkpoint-2572/scheduler.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:4d175d0495ec2005901bca7ae297edc36e69c6dfe66c46def57a73250c1f6823
3
  size 1064
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:99918e207b19aaa32a525127eabf1c25da26aa315bfed3f2135ce7a1c9f91265
3
  size 1064
training_checkpoints/checkpoint-2572/trainer_state.json CHANGED
@@ -1,5 +1,5 @@
1
  {
2
- "best_metric": 0.14496386130680605,
3
  "best_model_checkpoint": "roberta-base/checkpoint-2572",
4
  "epoch": 4.0,
5
  "eval_steps": 500,
@@ -10,125 +10,125 @@
10
  "log_history": [
11
  {
12
  "epoch": 0.78,
13
- "grad_norm": 6.534026145935059,
14
  "learning_rate": 4.742871954380509e-05,
15
- "loss": 2.2214,
16
  "step": 500
17
  },
18
  {
19
  "epoch": 1.0,
20
- "eval_accuracy": 0.24554608830364058,
21
- "eval_f1_macro": 0.02628524046434494,
22
- "eval_f1_micro": 0.24554608830364058,
23
- "eval_f1_weighted": 0.09681356964210704,
24
- "eval_loss": 2.1982107162475586,
25
- "eval_macro_fpr": 0.06666666666666667,
26
- "eval_macro_sensitivity": 0.06666666666666667,
27
- "eval_macro_specificity": 0.9333333333333333,
28
- "eval_precision": 0.06029288148121926,
29
- "eval_precision_macro": 0.016369739220242704,
30
- "eval_recall": 0.24554608830364058,
31
- "eval_recall_macro": 0.06666666666666667,
32
- "eval_runtime": 29.4439,
33
- "eval_samples_per_second": 43.846,
34
- "eval_steps_per_second": 5.502,
35
- "eval_weighted_fpr": 0.17997043606799704,
36
- "eval_weighted_sensitivity": 0.24554608830364058,
37
- "eval_weighted_specificity": 0.7544539116963594,
38
  "step": 643
39
  },
40
  {
41
  "epoch": 1.56,
42
- "grad_norm": 6.595059871673584,
43
  "learning_rate": 4.483670295489891e-05,
44
- "loss": 2.1462,
45
  "step": 1000
46
  },
47
  {
48
  "epoch": 2.0,
49
- "eval_accuracy": 0.3361735089078234,
50
- "eval_f1_macro": 0.06552880630375763,
51
- "eval_f1_micro": 0.3361735089078234,
52
- "eval_f1_weighted": 0.2010480796875688,
53
- "eval_loss": 1.9634978771209717,
54
- "eval_macro_fpr": 0.09092506634165738,
55
- "eval_macro_sensitivity": 0.11547020741602194,
56
- "eval_macro_specificity": 0.9457066851291582,
57
- "eval_precision": 0.1591168191834871,
58
- "eval_precision_macro": 0.05308920125936356,
59
- "eval_recall": 0.3361735089078234,
60
- "eval_recall_macro": 0.11547020741602194,
61
- "eval_runtime": 57.2389,
62
- "eval_samples_per_second": 22.555,
63
- "eval_steps_per_second": 2.83,
64
- "eval_weighted_fpr": 0.12361171210154334,
65
- "eval_weighted_sensitivity": 0.3361735089078234,
66
- "eval_weighted_specificity": 0.84942676802955,
67
  "step": 1286
68
  },
69
  {
70
  "epoch": 2.33,
71
- "grad_norm": 41.05898666381836,
72
- "learning_rate": 4.224987039917055e-05,
73
- "loss": 1.995,
74
  "step": 1500
75
  },
76
  {
77
  "epoch": 3.0,
78
- "eval_accuracy": 0.3555383423702556,
79
- "eval_f1_macro": 0.09312335075016234,
80
- "eval_f1_micro": 0.3555383423702556,
81
- "eval_f1_weighted": 0.2541975590745503,
82
- "eval_loss": 1.932247281074524,
83
- "eval_macro_fpr": 0.09537141294157879,
84
- "eval_macro_sensitivity": 0.14351969127084646,
85
- "eval_macro_specificity": 0.9497795632717652,
86
- "eval_precision": 0.23412920314698393,
87
- "eval_precision_macro": 0.09260367628400626,
88
- "eval_recall": 0.3555383423702556,
89
- "eval_recall_macro": 0.14351969127084646,
90
- "eval_runtime": 59.8887,
91
- "eval_samples_per_second": 21.557,
92
- "eval_steps_per_second": 2.705,
93
- "eval_weighted_fpr": 0.11463213006337834,
94
- "eval_weighted_sensitivity": 0.3555383423702556,
95
- "eval_weighted_specificity": 0.8911551067062222,
96
  "step": 1929
97
  },
98
  {
99
  "epoch": 3.11,
100
- "grad_norm": 4.287881851196289,
101
- "learning_rate": 3.96630378434422e-05,
102
- "loss": 2.0064,
103
  "step": 2000
104
  },
105
  {
106
  "epoch": 3.89,
107
- "grad_norm": 5.713494777679443,
108
- "learning_rate": 3.7076205287713846e-05,
109
- "loss": 1.8909,
110
  "step": 2500
111
  },
112
  {
113
  "epoch": 4.0,
114
- "eval_accuracy": 0.3787761425251743,
115
- "eval_f1_macro": 0.14496386130680605,
116
- "eval_f1_micro": 0.3787761425251743,
117
- "eval_f1_weighted": 0.29773714484044667,
118
- "eval_loss": 1.8874640464782715,
119
- "eval_macro_fpr": 0.08706956494211866,
120
- "eval_macro_sensitivity": 0.2191470222337379,
121
- "eval_macro_specificity": 0.9525422186332462,
122
- "eval_precision": 0.28749388015966415,
123
- "eval_precision_macro": 0.12703293957809556,
124
- "eval_recall": 0.3787761425251743,
125
- "eval_recall_macro": 0.2191470222337379,
126
- "eval_runtime": 69.4305,
127
- "eval_samples_per_second": 18.594,
128
- "eval_steps_per_second": 2.333,
129
- "eval_weighted_fpr": 0.10486401673640168,
130
- "eval_weighted_sensitivity": 0.3787761425251743,
131
- "eval_weighted_specificity": 0.9093571369735185,
132
  "step": 2572
133
  }
134
  ],
 
1
  {
2
+ "best_metric": 0.544445143585482,
3
  "best_model_checkpoint": "roberta-base/checkpoint-2572",
4
  "epoch": 4.0,
5
  "eval_steps": 500,
 
10
  "log_history": [
11
  {
12
  "epoch": 0.78,
13
+ "grad_norm": 16.478424072265625,
14
  "learning_rate": 4.742871954380509e-05,
15
+ "loss": 1.4921,
16
  "step": 500
17
  },
18
  {
19
  "epoch": 1.0,
20
+ "eval_accuracy": 0.6762199845081333,
21
+ "eval_f1_macro": 0.36762215914350266,
22
+ "eval_f1_micro": 0.6762199845081333,
23
+ "eval_f1_weighted": 0.6381553142782734,
24
+ "eval_loss": 1.0307424068450928,
25
+ "eval_macro_fpr": 0.03508857639652692,
26
+ "eval_macro_sensitivity": 0.4027183655220987,
27
+ "eval_macro_specificity": 0.9746655126680946,
28
+ "eval_precision": 0.6361951106730956,
29
+ "eval_precision_macro": 0.3745780279088578,
30
+ "eval_recall": 0.6762199845081333,
31
+ "eval_recall_macro": 0.4027183655220987,
32
+ "eval_runtime": 65.0146,
33
+ "eval_samples_per_second": 19.857,
34
+ "eval_steps_per_second": 2.492,
35
+ "eval_weighted_fpr": 0.03306962025316456,
36
+ "eval_weighted_sensitivity": 0.6762199845081333,
37
+ "eval_weighted_specificity": 0.9437627055132857,
38
  "step": 643
39
  },
40
  {
41
  "epoch": 1.56,
42
+ "grad_norm": 11.052178382873535,
43
  "learning_rate": 4.483670295489891e-05,
44
+ "loss": 0.9019,
45
  "step": 1000
46
  },
47
  {
48
  "epoch": 2.0,
49
+ "eval_accuracy": 0.737412858249419,
50
+ "eval_f1_macro": 0.4767493392755858,
51
+ "eval_f1_micro": 0.737412858249419,
52
+ "eval_f1_weighted": 0.7197263095885438,
53
+ "eval_loss": 0.8135831952095032,
54
+ "eval_macro_fpr": 0.025093207469991694,
55
+ "eval_macro_sensitivity": 0.5148741493607558,
56
+ "eval_macro_specificity": 0.9804978566683986,
57
+ "eval_precision": 0.7158327481302543,
58
+ "eval_precision_macro": 0.4625056436667857,
59
+ "eval_recall": 0.737412858249419,
60
+ "eval_recall_macro": 0.5148741493607558,
61
+ "eval_runtime": 78.3833,
62
+ "eval_samples_per_second": 16.47,
63
+ "eval_steps_per_second": 2.067,
64
+ "eval_weighted_fpr": 0.024804273066510573,
65
+ "eval_weighted_sensitivity": 0.737412858249419,
66
+ "eval_weighted_specificity": 0.9700549917765612,
67
  "step": 1286
68
  },
69
  {
70
  "epoch": 2.33,
71
+ "grad_norm": 16.875791549682617,
72
+ "learning_rate": 4.224468636599274e-05,
73
+ "loss": 0.7714,
74
  "step": 1500
75
  },
76
  {
77
  "epoch": 3.0,
78
+ "eval_accuracy": 0.7621998450813323,
79
+ "eval_f1_macro": 0.5064301619528891,
80
+ "eval_f1_micro": 0.7621998450813323,
81
+ "eval_f1_weighted": 0.7440787580787277,
82
+ "eval_loss": 0.8493772149085999,
83
+ "eval_macro_fpr": 0.022439395825223803,
84
+ "eval_macro_sensitivity": 0.5353612181578932,
85
+ "eval_macro_specificity": 0.9822327546765126,
86
+ "eval_precision": 0.7385639759374297,
87
+ "eval_precision_macro": 0.505572707108006,
88
+ "eval_recall": 0.7621998450813323,
89
+ "eval_recall_macro": 0.5353612181578932,
90
+ "eval_runtime": 62.8149,
91
+ "eval_samples_per_second": 20.552,
92
+ "eval_steps_per_second": 2.579,
93
+ "eval_weighted_fpr": 0.02179933252858056,
94
+ "eval_weighted_sensitivity": 0.7621998450813323,
95
+ "eval_weighted_specificity": 0.9712914750663563,
96
  "step": 1929
97
  },
98
  {
99
  "epoch": 3.11,
100
+ "grad_norm": 59.48842239379883,
101
+ "learning_rate": 3.9652669777086575e-05,
102
+ "loss": 0.7018,
103
  "step": 2000
104
  },
105
  {
106
  "epoch": 3.89,
107
+ "grad_norm": 1.6855363845825195,
108
+ "learning_rate": 3.706583722135822e-05,
109
+ "loss": 0.5351,
110
  "step": 2500
111
  },
112
  {
113
  "epoch": 4.0,
114
+ "eval_accuracy": 0.7645236250968241,
115
+ "eval_f1_macro": 0.544445143585482,
116
+ "eval_f1_micro": 0.7645236250968241,
117
+ "eval_f1_weighted": 0.7545581478665218,
118
+ "eval_loss": 0.9904704093933105,
119
+ "eval_macro_fpr": 0.022368675533492623,
120
+ "eval_macro_sensitivity": 0.5653277909563001,
121
+ "eval_macro_specificity": 0.9821237739107975,
122
+ "eval_precision": 0.7656722240785093,
123
+ "eval_precision_macro": 0.5495765557734748,
124
+ "eval_recall": 0.7645236250968241,
125
+ "eval_recall_macro": 0.5653277909563001,
126
+ "eval_runtime": 80.7211,
127
+ "eval_samples_per_second": 15.993,
128
+ "eval_steps_per_second": 2.007,
129
+ "eval_weighted_fpr": 0.021526695935419914,
130
+ "eval_weighted_sensitivity": 0.7645236250968241,
131
+ "eval_weighted_specificity": 0.9673329835651372,
132
  "step": 2572
133
  }
134
  ],
training_checkpoints/checkpoint-2572/training_args.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:6da235c4e1e89b590bb6c4dd543edc36c67b04a23baad1858c6c64a331ed4bd1
3
  size 4920
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:beb8f128167a5d05587c32e6e3bff806f690d3ab0996792b1d08193bcb3299f2
3
  size 4920