CodeIsAbstract commited on
Commit
4f04f6d
·
verified ·
1 Parent(s): c8886f1

Training in progress, step 20, checkpoint

Browse files
last-checkpoint/model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:43e8cce973730ae1df8b4f8a574251e0eb8d84e53f64786e1e366ca5fe36b401
3
  size 847599616
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3eff71d9a518a41bfb28e73ae1dd6b312a9a8275111eb44f36a482de0c686fd3
3
  size 847599616
last-checkpoint/optimizer.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:a037b3fb1050b981c2566e360b0f7bc7e519dcafb84360257615f51166e12d0f
3
  size 1386414411
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:451a047c67adb552f69b1ee57d6ccfbd975f28d2db27303ea08b3bb99222f1ce
3
  size 1386414411
last-checkpoint/rng_state_0.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:df9402a6cb264811460962fe076b4b0afaf8b5c58042e7c96e291b0ab753e219
3
  size 14917
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ffc94345284c067e63bc8b19cb79da3fce02d7f1d4fcfbf72afb2b30059f4b97
3
  size 14917
last-checkpoint/rng_state_1.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:b7a69ede4fdf179c7e9afdb737d70a6ea7d15e0d098b2d3fc81819822f211425
3
  size 14917
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:839bc332ed8a70d9ae7184583e63a4e9d83f0da96047149a53985c0c878892fc
3
  size 14917
last-checkpoint/scheduler.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:d67d86f802b2679f6c40dd9bf098b476c8f516c4ab864429fede96230ce6fe23
3
  size 1465
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:eb4b8e87ee0160fc90bd1f1a2198d12f8bd9bc37df783ac81324bc967f9edc62
3
  size 1465
last-checkpoint/trainer_state.json CHANGED
@@ -2,9 +2,9 @@
2
  "best_global_step": null,
3
  "best_metric": null,
4
  "best_model_checkpoint": null,
5
- "epoch": 0.01,
6
  "eval_steps": 5,
7
- "global_step": 10,
8
  "is_hyper_param_search": false,
9
  "is_local_process_zero": true,
10
  "is_world_process_zero": true,
@@ -26,6 +26,24 @@
26
  "eval_samples_per_second": 13.891,
27
  "eval_steps_per_second": 6.946,
28
  "step": 10
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
29
  }
30
  ],
31
  "logging_steps": 100,
 
2
  "best_global_step": null,
3
  "best_metric": null,
4
  "best_model_checkpoint": null,
5
+ "epoch": 0.02,
6
  "eval_steps": 5,
7
+ "global_step": 20,
8
  "is_hyper_param_search": false,
9
  "is_local_process_zero": true,
10
  "is_world_process_zero": true,
 
26
  "eval_samples_per_second": 13.891,
27
  "eval_steps_per_second": 6.946,
28
  "step": 10
29
+ },
30
+ {
31
+ "epoch": 0.015,
32
+ "eval_accuracy": 0.087,
33
+ "eval_loss": 18.806058883666992,
34
+ "eval_runtime": 40.1906,
35
+ "eval_samples_per_second": 12.441,
36
+ "eval_steps_per_second": 6.22,
37
+ "step": 15
38
+ },
39
+ {
40
+ "epoch": 0.02,
41
+ "eval_accuracy": 0.08553333333333334,
42
+ "eval_loss": 18.3583984375,
43
+ "eval_runtime": 36.0213,
44
+ "eval_samples_per_second": 13.881,
45
+ "eval_steps_per_second": 6.94,
46
+ "step": 20
47
  }
48
  ],
49
  "logging_steps": 100,