CodeIsAbstract commited on
Commit
3c24567
·
verified ·
1 Parent(s): 13d25dc

Training in progress, step 60, checkpoint

Browse files
last-checkpoint/model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:bc189f8541e9bc4a84030905691c0b69f1d5716fa245765b203313c77d3b518f
3
  size 847599616
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d661065b330d59c5ed2e4fb4b6a43688499e3bd7104b7349c11f7e3fdb9b9c21
3
  size 847599616
last-checkpoint/optimizer.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:2a3b709f88d6f874caf4fb6737b47139a2b346d313df7c6cb2faf2bb7358098f
3
  size 1386414411
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:19a5b07dd15e1e9303ca9bdb1cc0ad4bd111d5ba5e6d141125ec478a65a221d9
3
  size 1386414411
last-checkpoint/rng_state_0.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:8fea52185c391a64054fc74573ad8f90625b930c482bab8cba50e9c19046862f
3
  size 14917
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:2dbcc51e17bf9f30305c1120d7d28bfae15fa17f68068cbc1ada9c77b923011d
3
  size 14917
last-checkpoint/rng_state_1.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:ce1a92c6e2db27f53926de5f3b26e115416de2272d92901cec25035ecb005c98
3
  size 14917
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c2ee555d6cd5d24cb8f2a6db7c5284d6de90ae0739e324037854549d1ee329db
3
  size 14917
last-checkpoint/scheduler.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:7cdff73741e6eace61ffadce69b5334fe051107b57ca1ebe9321f07190142db5
3
  size 1465
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:fb800e07d5790b986f99bf8623894f6a4640212bee171e17fe91e27ad2f603b1
3
  size 1465
last-checkpoint/trainer_state.json CHANGED
@@ -2,9 +2,9 @@
2
  "best_global_step": null,
3
  "best_metric": null,
4
  "best_model_checkpoint": null,
5
- "epoch": 0.05,
6
  "eval_steps": 5,
7
- "global_step": 50,
8
  "is_hyper_param_search": false,
9
  "is_local_process_zero": true,
10
  "is_world_process_zero": true,
@@ -98,6 +98,24 @@
98
  "eval_samples_per_second": 14.079,
99
  "eval_steps_per_second": 7.04,
100
  "step": 50
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
101
  }
102
  ],
103
  "logging_steps": 100,
 
2
  "best_global_step": null,
3
  "best_metric": null,
4
  "best_model_checkpoint": null,
5
+ "epoch": 0.06,
6
  "eval_steps": 5,
7
+ "global_step": 60,
8
  "is_hyper_param_search": false,
9
  "is_local_process_zero": true,
10
  "is_world_process_zero": true,
 
98
  "eval_samples_per_second": 14.079,
99
  "eval_steps_per_second": 7.04,
100
  "step": 50
101
+ },
102
+ {
103
+ "epoch": 0.055,
104
+ "eval_accuracy": 0.08266666666666667,
105
+ "eval_loss": 17.291400909423828,
106
+ "eval_runtime": 40.6248,
107
+ "eval_samples_per_second": 12.308,
108
+ "eval_steps_per_second": 6.154,
109
+ "step": 55
110
+ },
111
+ {
112
+ "epoch": 0.06,
113
+ "eval_accuracy": 0.07613333333333333,
114
+ "eval_loss": 17.195777893066406,
115
+ "eval_runtime": 36.5259,
116
+ "eval_samples_per_second": 13.689,
117
+ "eval_steps_per_second": 6.844,
118
+ "step": 60
119
  }
120
  ],
121
  "logging_steps": 100,