CodeIsAbstract commited on
Commit
6c17417
·
verified ·
1 Parent(s): 3136603

Training in progress, step 500, checkpoint

Browse files
last-checkpoint/optimizer.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:f5805072dd72dbaa444aa95ea79904fe117bd9e08603dd8903d889b35eb5d72c
3
+ size 386379
last-checkpoint/pytorch_model.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:0b50dc3b8d7f6527e6deb35523fc5f4f66de87b59bae32d7b673859cc29de173
3
+ size 1540661735
last-checkpoint/rng_state_0.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:1ffdf794aa37bf66c11fbf3a25c5c6e95b77bf37b30e60af016fc9124d0bcb99
3
+ size 14469
last-checkpoint/rng_state_1.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:81af6df700759cf275cafea0cdaf381ba3c2b41fab7e7379341c665c147ed0de
3
+ size 14469
last-checkpoint/rng_state_2.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d55b42bedc0f28bff9c30b7bebe80ce64a5aa5c0c36daab2e46abff72980db18
3
+ size 14469
last-checkpoint/rng_state_3.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ef44384c481d885f2114df6c79173cd8acc16cb1ee47046bf46031abdcc9c81b
3
+ size 14469
last-checkpoint/rng_state_4.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c41a4b4c8c4b93050c780cbd4537fecb50bacfb6229c463432858be6d6a803f6
3
+ size 14469
last-checkpoint/rng_state_5.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d79aee2c3afea7ec6ffe3ac7b43481b7334a7abba51e0d4f2ed2312cd5550aeb
3
+ size 14469
last-checkpoint/rng_state_6.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c918f0602d1108574e113fb8e32d725731b2c86339c03552c0229840eb091bf8
3
+ size 14469
last-checkpoint/rng_state_7.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c2f462384e1628ac3068742a9ce939fc67956eb63350336c85c9bc3aee27af07
3
+ size 14469
last-checkpoint/scheduler.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9f532a77c9963a928cf7277c87e919c365cd36b1e11776f70173ba96ec9da717
3
+ size 1465
last-checkpoint/trainer_state.json ADDED
@@ -0,0 +1,114 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "best_global_step": null,
3
+ "best_metric": null,
4
+ "best_model_checkpoint": null,
5
+ "epoch": 0.5,
6
+ "eval_steps": 100,
7
+ "global_step": 500,
8
+ "is_hyper_param_search": false,
9
+ "is_local_process_zero": false,
10
+ "is_world_process_zero": true,
11
+ "log_history": [
12
+ {
13
+ "epoch": 0.1,
14
+ "grad_norm": 1.0159783363342285,
15
+ "learning_rate": 0.003920764340590609,
16
+ "loss": 67.322138671875,
17
+ "step": 100
18
+ },
19
+ {
20
+ "epoch": 0.1,
21
+ "eval_accuracy": 0.1363150684931507,
22
+ "eval_loss": 62.45854568481445,
23
+ "eval_runtime": 15.2216,
24
+ "eval_samples_per_second": 8.212,
25
+ "eval_steps_per_second": 0.263,
26
+ "step": 100
27
+ },
28
+ {
29
+ "epoch": 0.2,
30
+ "grad_norm": 1.178174614906311,
31
+ "learning_rate": 0.003650943793925548,
32
+ "loss": 60.51267578125,
33
+ "step": 200
34
+ },
35
+ {
36
+ "epoch": 0.2,
37
+ "eval_accuracy": 0.14354794520547945,
38
+ "eval_loss": 59.48474884033203,
39
+ "eval_runtime": 3.1576,
40
+ "eval_samples_per_second": 39.587,
41
+ "eval_steps_per_second": 1.267,
42
+ "step": 200
43
+ },
44
+ {
45
+ "epoch": 0.3,
46
+ "grad_norm": 0.9601056575775146,
47
+ "learning_rate": 0.0032162636906540357,
48
+ "loss": 58.783408203125,
49
+ "step": 300
50
+ },
51
+ {
52
+ "epoch": 0.3,
53
+ "eval_accuracy": 0.14687671232876712,
54
+ "eval_loss": 58.058326721191406,
55
+ "eval_runtime": 3.3957,
56
+ "eval_samples_per_second": 36.812,
57
+ "eval_steps_per_second": 1.178,
58
+ "step": 300
59
+ },
60
+ {
61
+ "epoch": 0.4,
62
+ "grad_norm": 0.6054814457893372,
63
+ "learning_rate": 0.0026601302141692667,
64
+ "loss": 57.62333984375,
65
+ "step": 400
66
+ },
67
+ {
68
+ "epoch": 0.4,
69
+ "eval_accuracy": 0.1496399217221135,
70
+ "eval_loss": 57.01893615722656,
71
+ "eval_runtime": 3.9547,
72
+ "eval_samples_per_second": 31.608,
73
+ "eval_steps_per_second": 1.011,
74
+ "step": 400
75
+ },
76
+ {
77
+ "epoch": 0.5,
78
+ "grad_norm": 0.638672411441803,
79
+ "learning_rate": 0.002038077610206693,
80
+ "loss": 56.62125,
81
+ "step": 500
82
+ },
83
+ {
84
+ "epoch": 0.5,
85
+ "eval_accuracy": 0.151720156555773,
86
+ "eval_loss": 56.300567626953125,
87
+ "eval_runtime": 3.3169,
88
+ "eval_samples_per_second": 37.686,
89
+ "eval_steps_per_second": 1.206,
90
+ "step": 500
91
+ }
92
+ ],
93
+ "logging_steps": 100,
94
+ "max_steps": 1000,
95
+ "num_input_tokens_seen": 0,
96
+ "num_train_epochs": 9223372036854775807,
97
+ "save_steps": 500,
98
+ "stateful_callbacks": {
99
+ "TrainerControl": {
100
+ "args": {
101
+ "should_epoch_stop": false,
102
+ "should_evaluate": false,
103
+ "should_log": false,
104
+ "should_save": true,
105
+ "should_training_stop": false
106
+ },
107
+ "attributes": {}
108
+ }
109
+ },
110
+ "total_flos": 0.0,
111
+ "train_batch_size": 4,
112
+ "trial_name": null,
113
+ "trial_params": null
114
+ }
last-checkpoint/training_args.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:4ca316f954a0e91646cfe7cc48ead82990c29283d2e6825936de0377c3707c2e
3
+ size 5265