hanngao commited on
Commit
2ace48b
·
verified ·
1 Parent(s): 08c56aa

Training in progress, epoch 1

Browse files
Files changed (4) hide show
  1. all_results.json +11 -11
  2. eval_results.json +6 -6
  3. model.safetensors +1 -1
  4. train_results.json +6 -6
all_results.json CHANGED
@@ -1,13 +1,13 @@
1
  {
2
- "epoch": 4.0,
3
- "eval_accuracy": 0.7345,
4
- "eval_loss": 1.1040924787521362,
5
- "eval_runtime": 100.5374,
6
- "eval_samples_per_second": 19.893,
7
- "eval_steps_per_second": 1.243,
8
- "total_flos": 2.501924375494656e+18,
9
- "train_loss": 0.5490640802308917,
10
- "train_runtime": 1980.4296,
11
- "train_samples_per_second": 40.395,
12
- "train_steps_per_second": 0.081
13
  }
 
1
  {
2
+ "epoch": 3.0,
3
+ "eval_accuracy": 0.789,
4
+ "eval_loss": 0.8204972743988037,
5
+ "eval_runtime": 98.6396,
6
+ "eval_samples_per_second": 20.276,
7
+ "eval_steps_per_second": 1.267,
8
+ "total_flos": 1.876443281620992e+18,
9
+ "train_loss": 0.4405735259254773,
10
+ "train_runtime": 1487.7002,
11
+ "train_samples_per_second": 53.774,
12
+ "train_steps_per_second": 0.108
13
  }
eval_results.json CHANGED
@@ -1,8 +1,8 @@
1
  {
2
- "epoch": 4.0,
3
- "eval_accuracy": 0.7345,
4
- "eval_loss": 1.1040924787521362,
5
- "eval_runtime": 100.5374,
6
- "eval_samples_per_second": 19.893,
7
- "eval_steps_per_second": 1.243
8
  }
 
1
  {
2
+ "epoch": 3.0,
3
+ "eval_accuracy": 0.789,
4
+ "eval_loss": 0.8204972743988037,
5
+ "eval_runtime": 98.6396,
6
+ "eval_samples_per_second": 20.276,
7
+ "eval_steps_per_second": 1.267
8
  }
model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:4463b5d2a15f49e3fe254d29ac15a3013e09f79a1aa45554a48914c5dd438748
3
  size 346293856
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c813c0dbd822da8514932dbbec01648b0256caad1eac079b51d006ea985af7a0
3
  size 346293856
train_results.json CHANGED
@@ -1,8 +1,8 @@
1
  {
2
- "epoch": 4.0,
3
- "total_flos": 2.501924375494656e+18,
4
- "train_loss": 0.5490640802308917,
5
- "train_runtime": 1980.4296,
6
- "train_samples_per_second": 40.395,
7
- "train_steps_per_second": 0.081
8
  }
 
1
  {
2
+ "epoch": 3.0,
3
+ "total_flos": 1.876443281620992e+18,
4
+ "train_loss": 0.4405735259254773,
5
+ "train_runtime": 1487.7002,
6
+ "train_samples_per_second": 53.774,
7
+ "train_steps_per_second": 0.108
8
  }