CodeIsAbstract commited on
Commit
7eefaff
·
verified ·
1 Parent(s): 01b5ca1

Training in progress, step 140, checkpoint

Browse files
last-checkpoint/model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:a6d295a5a7fcb5fae0eebc663a6b5b8464d827143f0cb5ddb71102882515dca5
3
  size 847599616
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:217d3946b7803902022eec7cfd8fe9488050ab79dfd3fbe7b1875bbd6d1ae713
3
  size 847599616
last-checkpoint/optimizer.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:af514a87c4fb89e819a0de6991ca4d8b39dfdf48dc925262f1e975aeec90cc78
3
  size 1386414411
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d3bd819f5f239a35fa547eccf498f447b392f7befceb13f93b74e1b0076ad315
3
  size 1386414411
last-checkpoint/rng_state_0.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:5d3db644955f6e2a187227317743d07ffbb076761cb028b27ef16d496ba7ec50
3
  size 14917
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:f0c3a7585079a88f7e60217509a0b7358c2fc795f19cc94faeed7068f7d0ce34
3
  size 14917
last-checkpoint/rng_state_1.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:635a41db05223968dc5ce13f82d086b8ff5047cb0e8da854e4e7ef09ab47f41a
3
  size 14917
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:692fc434e90b39dd1c760af3bb9bd206fa31fb36c8e62d4b9a61187caf62dd58
3
  size 14917
last-checkpoint/scheduler.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:767fe410c841707b701d3e837145bc5c2e9de990fa720929b20bfefc7ae3ad3a
3
  size 1465
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:055103685036cd172833dfba9d67c8c5638fe5ea929e5909dfadcb533f6d9014
3
  size 1465
last-checkpoint/trainer_state.json CHANGED
@@ -2,9 +2,9 @@
2
  "best_global_step": null,
3
  "best_metric": null,
4
  "best_model_checkpoint": null,
5
- "epoch": 0.13,
6
  "eval_steps": 5,
7
- "global_step": 130,
8
  "is_hyper_param_search": false,
9
  "is_local_process_zero": true,
10
  "is_world_process_zero": true,
@@ -249,6 +249,24 @@
249
  "eval_samples_per_second": 14.285,
250
  "eval_steps_per_second": 7.142,
251
  "step": 130
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
252
  }
253
  ],
254
  "logging_steps": 100,
 
2
  "best_global_step": null,
3
  "best_metric": null,
4
  "best_model_checkpoint": null,
5
+ "epoch": 0.14,
6
  "eval_steps": 5,
7
+ "global_step": 140,
8
  "is_hyper_param_search": false,
9
  "is_local_process_zero": true,
10
  "is_world_process_zero": true,
 
249
  "eval_samples_per_second": 14.285,
250
  "eval_steps_per_second": 7.142,
251
  "step": 130
252
+ },
253
+ {
254
+ "epoch": 0.135,
255
+ "eval_accuracy": 0.0726,
256
+ "eval_loss": 16.65378189086914,
257
+ "eval_runtime": 39.4554,
258
+ "eval_samples_per_second": 12.673,
259
+ "eval_steps_per_second": 6.336,
260
+ "step": 135
261
+ },
262
+ {
263
+ "epoch": 0.14,
264
+ "eval_accuracy": 0.0776,
265
+ "eval_loss": 16.60840606689453,
266
+ "eval_runtime": 35.1512,
267
+ "eval_samples_per_second": 14.224,
268
+ "eval_steps_per_second": 7.112,
269
+ "step": 140
270
  }
271
  ],
272
  "logging_steps": 100,