CodeIsAbstract commited on
Commit
39783c7
·
verified ·
1 Parent(s): e8812bf

Training in progress, step 500, checkpoint

Browse files
last-checkpoint/optimizer.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:71a54c527a33f70d78ce72260eeb46972b58e885b72ef3dfa0e6cc0f9688399f
3
+ size 386379
last-checkpoint/pytorch_model.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:cd76ca7ba0bf198b8ad479ccdd911afaab0648bdaf7b3f0f15806b98b32231d0
3
+ size 1540661735
last-checkpoint/rng_state_0.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:21921ded89d3efb325b0f105635a2e638ac3849bf9d5ddc032cf285c7acce9df
3
+ size 14469
last-checkpoint/rng_state_1.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:2c3ef5862d26b8869e6c9e8a6807701995c18e51a48f7f36ceda1b5abeed0909
3
+ size 14469
last-checkpoint/rng_state_2.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e2ffd59099867021edcfb0ac2baab041eb4a4af12f556bedc1ab80ec65d990ef
3
+ size 14469
last-checkpoint/rng_state_3.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:33e740bf1fa07b2703f88f14c6cf127f399fc76fbcdb55bc579c2b3e0e29cc02
3
+ size 14469
last-checkpoint/rng_state_4.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:97342e1218bd168184eb81a3ba9ece8327ff8377151f7c84b89a8ad1cc5bf7ed
3
+ size 14469
last-checkpoint/rng_state_5.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:402e70719eb092137380f0c146f2dd612f92092b503b35850f99d43e15b22645
3
+ size 14469
last-checkpoint/rng_state_6.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:4f39d1c0b40d5df607853ccb440ef174a83084d925f20ee2125e5030a6c85632
3
+ size 14469
last-checkpoint/rng_state_7.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:6dcd028341979c2e359a61e18bb04bf5424e94e780cb8c2f9bc4ed21b1f02b37
3
+ size 14469
last-checkpoint/scheduler.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5b79cc0df1e63ecef3adaaf8ef4c455eb58ccb70431c624030057057995b60a8
3
+ size 1465
last-checkpoint/trainer_state.json ADDED
@@ -0,0 +1,159 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "best_global_step": null,
3
+ "best_metric": null,
4
+ "best_model_checkpoint": null,
5
+ "epoch": 0.5,
6
+ "eval_steps": 50,
7
+ "global_step": 500,
8
+ "is_hyper_param_search": false,
9
+ "is_local_process_zero": false,
10
+ "is_world_process_zero": true,
11
+ "log_history": [
12
+ {
13
+ "epoch": 0.05,
14
+ "eval_accuracy": 0.14088188976377952,
15
+ "eval_loss": 49.78975296020508,
16
+ "eval_runtime": 13.6275,
17
+ "eval_samples_per_second": 9.173,
18
+ "eval_steps_per_second": 1.174,
19
+ "step": 50
20
+ },
21
+ {
22
+ "epoch": 0.1,
23
+ "grad_norm": 13452.2255859375,
24
+ "learning_rate": 0.000264,
25
+ "loss": 1505.6178125,
26
+ "step": 100
27
+ },
28
+ {
29
+ "epoch": 0.1,
30
+ "eval_accuracy": 0.1445748031496063,
31
+ "eval_loss": 49.24732208251953,
32
+ "eval_runtime": 8.7677,
33
+ "eval_samples_per_second": 14.257,
34
+ "eval_steps_per_second": 1.825,
35
+ "step": 100
36
+ },
37
+ {
38
+ "epoch": 0.15,
39
+ "eval_accuracy": 0.1491968503937008,
40
+ "eval_loss": 48.760948181152344,
41
+ "eval_runtime": 8.1271,
42
+ "eval_samples_per_second": 15.381,
43
+ "eval_steps_per_second": 1.969,
44
+ "step": 150
45
+ },
46
+ {
47
+ "epoch": 0.2,
48
+ "grad_norm": 8017.09326171875,
49
+ "learning_rate": 0.0003967291041791484,
50
+ "loss": 1469.6371875,
51
+ "step": 200
52
+ },
53
+ {
54
+ "epoch": 0.2,
55
+ "eval_accuracy": 0.15311023622047243,
56
+ "eval_loss": 48.39834213256836,
57
+ "eval_runtime": 8.3927,
58
+ "eval_samples_per_second": 14.894,
59
+ "eval_steps_per_second": 1.906,
60
+ "step": 200
61
+ },
62
+ {
63
+ "epoch": 0.25,
64
+ "eval_accuracy": 0.15462204724409448,
65
+ "eval_loss": 48.1512336730957,
66
+ "eval_runtime": 10.9865,
67
+ "eval_samples_per_second": 11.378,
68
+ "eval_steps_per_second": 1.456,
69
+ "step": 250
70
+ },
71
+ {
72
+ "epoch": 0.3,
73
+ "grad_norm": 9418.4111328125,
74
+ "learning_rate": 0.0003704314025795668,
75
+ "loss": 1449.61,
76
+ "step": 300
77
+ },
78
+ {
79
+ "epoch": 0.3,
80
+ "eval_accuracy": 0.15623622047244096,
81
+ "eval_loss": 47.92970275878906,
82
+ "eval_runtime": 8.5559,
83
+ "eval_samples_per_second": 14.61,
84
+ "eval_steps_per_second": 1.87,
85
+ "step": 300
86
+ },
87
+ {
88
+ "epoch": 0.35,
89
+ "eval_accuracy": 0.15805511811023623,
90
+ "eval_loss": 47.6953125,
91
+ "eval_runtime": 10.9375,
92
+ "eval_samples_per_second": 11.429,
93
+ "eval_steps_per_second": 1.463,
94
+ "step": 350
95
+ },
96
+ {
97
+ "epoch": 0.4,
98
+ "grad_norm": 3742.375,
99
+ "learning_rate": 0.0003211159956686115,
100
+ "loss": 1437.1715625,
101
+ "step": 400
102
+ },
103
+ {
104
+ "epoch": 0.4,
105
+ "eval_accuracy": 0.16048031496062992,
106
+ "eval_loss": 47.554046630859375,
107
+ "eval_runtime": 8.2976,
108
+ "eval_samples_per_second": 15.065,
109
+ "eval_steps_per_second": 1.928,
110
+ "step": 400
111
+ },
112
+ {
113
+ "epoch": 0.45,
114
+ "eval_accuracy": 0.16221259842519686,
115
+ "eval_loss": 47.40172576904297,
116
+ "eval_runtime": 7.9017,
117
+ "eval_samples_per_second": 15.819,
118
+ "eval_steps_per_second": 2.025,
119
+ "step": 450
120
+ },
121
+ {
122
+ "epoch": 0.5,
123
+ "grad_norm": 12861.1259765625,
124
+ "learning_rate": 0.00025544320241571017,
125
+ "loss": 1426.95953125,
126
+ "step": 500
127
+ },
128
+ {
129
+ "epoch": 0.5,
130
+ "eval_accuracy": 0.1636220472440945,
131
+ "eval_loss": 47.27663803100586,
132
+ "eval_runtime": 8.5898,
133
+ "eval_samples_per_second": 14.552,
134
+ "eval_steps_per_second": 1.863,
135
+ "step": 500
136
+ }
137
+ ],
138
+ "logging_steps": 100,
139
+ "max_steps": 1000,
140
+ "num_input_tokens_seen": 0,
141
+ "num_train_epochs": 9223372036854775807,
142
+ "save_steps": 500,
143
+ "stateful_callbacks": {
144
+ "TrainerControl": {
145
+ "args": {
146
+ "should_epoch_stop": false,
147
+ "should_evaluate": false,
148
+ "should_log": false,
149
+ "should_save": true,
150
+ "should_training_stop": false
151
+ },
152
+ "attributes": {}
153
+ }
154
+ },
155
+ "total_flos": 0.0,
156
+ "train_batch_size": 1,
157
+ "trial_name": null,
158
+ "trial_params": null
159
+ }
last-checkpoint/training_args.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:247a6cb50101bbd16e7c8df652ac2c86b414e5a68a9035c7ff0bb74f21ee442f
3
+ size 5265