CodeIsAbstract commited on
Commit
2261df5
·
verified ·
1 Parent(s): 4c5923d

Training in progress, step 50, checkpoint

Browse files
last-checkpoint/model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:0d958dad02f3b2e6ea7beea0420d12217ac04c6a2b8455de924332950dc499f4
3
  size 847599616
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:bc189f8541e9bc4a84030905691c0b69f1d5716fa245765b203313c77d3b518f
3
  size 847599616
last-checkpoint/optimizer.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:63aa44604eb464344bd334ce0ace2ddf2d762d75b71cd3c583c26377b07dc682
3
  size 1386414411
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:2a3b709f88d6f874caf4fb6737b47139a2b346d313df7c6cb2faf2bb7358098f
3
  size 1386414411
last-checkpoint/rng_state_0.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:93a357e5b1929d381bd37f7e838c91f79a5b628f901145c5c5bba6f05dbff3bd
3
  size 14917
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:8fea52185c391a64054fc74573ad8f90625b930c482bab8cba50e9c19046862f
3
  size 14917
last-checkpoint/rng_state_1.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:8a516434599c7f0d47c0ad37fc7c45bbf4f4262d2a73b4c8a12bc19f1d3964f7
3
  size 14917
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ce1a92c6e2db27f53926de5f3b26e115416de2272d92901cec25035ecb005c98
3
  size 14917
last-checkpoint/scheduler.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:448f72b41b3dbafcf0f9a5ec0a4ef0fd2acb0b41f457d9ddd823e6fee9268340
3
  size 1465
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:7cdff73741e6eace61ffadce69b5334fe051107b57ca1ebe9321f07190142db5
3
  size 1465
last-checkpoint/trainer_state.json CHANGED
@@ -2,9 +2,9 @@
2
  "best_global_step": null,
3
  "best_metric": null,
4
  "best_model_checkpoint": null,
5
- "epoch": 0.04,
6
  "eval_steps": 5,
7
- "global_step": 40,
8
  "is_hyper_param_search": false,
9
  "is_local_process_zero": true,
10
  "is_world_process_zero": true,
@@ -80,6 +80,24 @@
80
  "eval_samples_per_second": 14.065,
81
  "eval_steps_per_second": 7.032,
82
  "step": 40
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
83
  }
84
  ],
85
  "logging_steps": 100,
 
2
  "best_global_step": null,
3
  "best_metric": null,
4
  "best_model_checkpoint": null,
5
+ "epoch": 0.05,
6
  "eval_steps": 5,
7
+ "global_step": 50,
8
  "is_hyper_param_search": false,
9
  "is_local_process_zero": true,
10
  "is_world_process_zero": true,
 
80
  "eval_samples_per_second": 14.065,
81
  "eval_steps_per_second": 7.032,
82
  "step": 40
83
+ },
84
+ {
85
+ "epoch": 0.045,
86
+ "eval_accuracy": 0.08,
87
+ "eval_loss": 17.587928771972656,
88
+ "eval_runtime": 40.4006,
89
+ "eval_samples_per_second": 12.376,
90
+ "eval_steps_per_second": 6.188,
91
+ "step": 45
92
+ },
93
+ {
94
+ "epoch": 0.05,
95
+ "eval_accuracy": 0.07426666666666666,
96
+ "eval_loss": 17.396371841430664,
97
+ "eval_runtime": 35.5138,
98
+ "eval_samples_per_second": 14.079,
99
+ "eval_steps_per_second": 7.04,
100
+ "step": 50
101
  }
102
  ],
103
  "logging_steps": 100,