Training in progress, step 60, checkpoint
Browse files
last-checkpoint/model.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
size 847599616
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:d661065b330d59c5ed2e4fb4b6a43688499e3bd7104b7349c11f7e3fdb9b9c21
|
| 3 |
size 847599616
|
last-checkpoint/optimizer.pt
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
size 1386414411
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:19a5b07dd15e1e9303ca9bdb1cc0ad4bd111d5ba5e6d141125ec478a65a221d9
|
| 3 |
size 1386414411
|
last-checkpoint/rng_state_0.pth
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
size 14917
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:2dbcc51e17bf9f30305c1120d7d28bfae15fa17f68068cbc1ada9c77b923011d
|
| 3 |
size 14917
|
last-checkpoint/rng_state_1.pth
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
size 14917
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:c2ee555d6cd5d24cb8f2a6db7c5284d6de90ae0739e324037854549d1ee329db
|
| 3 |
size 14917
|
last-checkpoint/scheduler.pt
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
size 1465
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:fb800e07d5790b986f99bf8623894f6a4640212bee171e17fe91e27ad2f603b1
|
| 3 |
size 1465
|
last-checkpoint/trainer_state.json
CHANGED
|
@@ -2,9 +2,9 @@
|
|
| 2 |
"best_global_step": null,
|
| 3 |
"best_metric": null,
|
| 4 |
"best_model_checkpoint": null,
|
| 5 |
-
"epoch": 0.
|
| 6 |
"eval_steps": 5,
|
| 7 |
-
"global_step":
|
| 8 |
"is_hyper_param_search": false,
|
| 9 |
"is_local_process_zero": true,
|
| 10 |
"is_world_process_zero": true,
|
|
@@ -98,6 +98,24 @@
|
|
| 98 |
"eval_samples_per_second": 14.079,
|
| 99 |
"eval_steps_per_second": 7.04,
|
| 100 |
"step": 50
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 101 |
}
|
| 102 |
],
|
| 103 |
"logging_steps": 100,
|
|
|
|
| 2 |
"best_global_step": null,
|
| 3 |
"best_metric": null,
|
| 4 |
"best_model_checkpoint": null,
|
| 5 |
+
"epoch": 0.06,
|
| 6 |
"eval_steps": 5,
|
| 7 |
+
"global_step": 60,
|
| 8 |
"is_hyper_param_search": false,
|
| 9 |
"is_local_process_zero": true,
|
| 10 |
"is_world_process_zero": true,
|
|
|
|
| 98 |
"eval_samples_per_second": 14.079,
|
| 99 |
"eval_steps_per_second": 7.04,
|
| 100 |
"step": 50
|
| 101 |
+
},
|
| 102 |
+
{
|
| 103 |
+
"epoch": 0.055,
|
| 104 |
+
"eval_accuracy": 0.08266666666666667,
|
| 105 |
+
"eval_loss": 17.291400909423828,
|
| 106 |
+
"eval_runtime": 40.6248,
|
| 107 |
+
"eval_samples_per_second": 12.308,
|
| 108 |
+
"eval_steps_per_second": 6.154,
|
| 109 |
+
"step": 55
|
| 110 |
+
},
|
| 111 |
+
{
|
| 112 |
+
"epoch": 0.06,
|
| 113 |
+
"eval_accuracy": 0.07613333333333333,
|
| 114 |
+
"eval_loss": 17.195777893066406,
|
| 115 |
+
"eval_runtime": 36.5259,
|
| 116 |
+
"eval_samples_per_second": 13.689,
|
| 117 |
+
"eval_steps_per_second": 6.844,
|
| 118 |
+
"step": 60
|
| 119 |
}
|
| 120 |
],
|
| 121 |
"logging_steps": 100,
|