CodeIsAbstract commited on
Commit
ce4224e
·
verified ·
1 Parent(s): 2ed3bf3

Training in progress, step 90, checkpoint

Browse files
last-checkpoint/model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:ffded77dbe5849f717ceec3a8e05e32f2accc34f67a38414e5a8628ec6482874
3
  size 847599616
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:05146d0139b00f4be557d2f9fb9850bd3c3eef0191546e8127aeaca409558595
3
  size 847599616
last-checkpoint/optimizer.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:4b81aec63631cf3d99093746f160b7b04db79c246f3e802e4cdcf3b2e337e823
3
  size 1386414411
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d763a617ca5e65007be84779b9da87d83b12cd96b4abaead9266b6ea7c245274
3
  size 1386414411
last-checkpoint/rng_state_0.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:6427194f9035b62d203772b7f8860b70a156c72e5e2aa512f0b705b44137fbf4
3
  size 14917
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c27d5e9c91dc5b481af1a74df9cf562559184e94009cb11852e3c2011ad2ace9
3
  size 14917
last-checkpoint/rng_state_1.pth CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:5e00fe96875163560113675800aca8f3ff0896df20c4b9639585c87e713e56c8
3
  size 14917
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:50f189793170f205a894136fd88e55d8f1f19c6ff974d6ec6c00c36064a79076
3
  size 14917
last-checkpoint/scheduler.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:8cdffd4f448e38d1e13d54e0da12d65b4a70306f7569df188f294ba615d9017e
3
  size 1465
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c546bfb0b72265a73baa6ed5d9e7f51e075e736bf2a6896c42c569e9647b77e7
3
  size 1465
last-checkpoint/trainer_state.json CHANGED
@@ -2,9 +2,9 @@
2
  "best_global_step": null,
3
  "best_metric": null,
4
  "best_model_checkpoint": null,
5
- "epoch": 0.08,
6
  "eval_steps": 5,
7
- "global_step": 80,
8
  "is_hyper_param_search": false,
9
  "is_local_process_zero": true,
10
  "is_world_process_zero": true,
@@ -152,6 +152,24 @@
152
  "eval_samples_per_second": 14.01,
153
  "eval_steps_per_second": 7.005,
154
  "step": 80
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
155
  }
156
  ],
157
  "logging_steps": 100,
 
2
  "best_global_step": null,
3
  "best_metric": null,
4
  "best_model_checkpoint": null,
5
+ "epoch": 0.09,
6
  "eval_steps": 5,
7
+ "global_step": 90,
8
  "is_hyper_param_search": false,
9
  "is_local_process_zero": true,
10
  "is_world_process_zero": true,
 
152
  "eval_samples_per_second": 14.01,
153
  "eval_steps_per_second": 7.005,
154
  "step": 80
155
+ },
156
+ {
157
+ "epoch": 0.085,
158
+ "eval_accuracy": 0.0764,
159
+ "eval_loss": 16.9167537689209,
160
+ "eval_runtime": 40.3553,
161
+ "eval_samples_per_second": 12.39,
162
+ "eval_steps_per_second": 6.195,
163
+ "step": 85
164
+ },
165
+ {
166
+ "epoch": 0.09,
167
+ "eval_accuracy": 0.0748,
168
+ "eval_loss": 16.922040939331055,
169
+ "eval_runtime": 36.0637,
170
+ "eval_samples_per_second": 13.864,
171
+ "eval_steps_per_second": 6.932,
172
+ "step": 90
173
  }
174
  ],
175
  "logging_steps": 100,