rovdetection commited on
Commit
e3d43ea
·
verified ·
1 Parent(s): df44e50

Training in progress, step 500, checkpoint

Browse files
last-checkpoint/model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:8aa3494fcf8494e09510fdd6776d0909cf904525f8cd5f22a4471c95b1e88171
3
  size 4523108832
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:908d63b2fb95e71a4b8ee8cd59f37ef260ee9dd802b3a17cb85987465ed26fc2
3
  size 4523108832
last-checkpoint/optimizer.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:c507e6a606d3533b83e8f04601bd517d0a24ef5e596488e4b831b5b264ac9765
3
  size 2911851147
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:95b772b50d78c29d75a1c5944f3fcaf71a43acfdc8bc9012b0e89bacc4c8bb3a
3
  size 2911851147
last-checkpoint/scheduler.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:33636888fde43e822c3af154b63f927ea6cf358e4f8066b8af48942935ee0380
3
  size 1465
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:45aec2cb58874aade57e0968443233716fc5740d4d156942f30784ba9a8ef170
3
  size 1465
last-checkpoint/trainer_state.json CHANGED
@@ -11,72 +11,72 @@
11
  "log_history": [
12
  {
13
  "epoch": 0.005,
14
- "grad_norm": 2.8277900218963623,
15
- "learning_rate": 1.125e-05,
16
- "loss": 7.685114135742188,
17
  "step": 50
18
  },
19
  {
20
  "epoch": 0.01,
21
- "grad_norm": 2.2731411457061768,
22
- "learning_rate": 2.2250000000000002e-05,
23
- "loss": 5.033958129882812,
24
  "step": 100
25
  },
26
  {
27
  "epoch": 0.015,
28
- "grad_norm": 3.3346173763275146,
29
- "learning_rate": 3.35e-05,
30
- "loss": 4.662413940429688,
31
  "step": 150
32
  },
33
  {
34
  "epoch": 0.02,
35
- "grad_norm": 3.638383626937866,
36
- "learning_rate": 4.4750000000000004e-05,
37
- "loss": 5.785809936523438,
38
  "step": 200
39
  },
40
  {
41
  "epoch": 0.025,
42
- "grad_norm": 2.827432632446289,
43
- "learning_rate": 4.999919714835816e-05,
44
- "loss": 7.300284423828125,
45
  "step": 250
46
  },
47
  {
48
  "epoch": 0.03,
49
- "grad_norm": 2.6586380004882812,
50
- "learning_rate": 4.999277464461405e-05,
51
- "loss": 8.245166625976562,
52
  "step": 300
53
  },
54
  {
55
  "epoch": 0.035,
56
- "grad_norm": 2.42388653755188,
57
- "learning_rate": 4.9979931287121e-05,
58
- "loss": 9.312975463867188,
59
  "step": 350
60
  },
61
  {
62
  "epoch": 0.04,
63
- "grad_norm": 2.5717973709106445,
64
- "learning_rate": 4.996067037544542e-05,
65
- "loss": 10.216683959960937,
66
  "step": 400
67
  },
68
  {
69
  "epoch": 0.045,
70
- "grad_norm": 2.759148120880127,
71
- "learning_rate": 4.9934996857877325e-05,
72
- "loss": 11.017779541015624,
73
  "step": 450
74
  },
75
  {
76
  "epoch": 0.05,
77
- "grad_norm": 2.2197604179382324,
78
- "learning_rate": 4.9902917330159036e-05,
79
- "loss": 11.715665283203125,
80
  "step": 500
81
  }
82
  ],
 
11
  "log_history": [
12
  {
13
  "epoch": 0.005,
14
+ "grad_norm": 7.283497333526611,
15
+ "learning_rate": 2.7e-06,
16
+ "loss": 9.9652685546875,
17
  "step": 50
18
  },
19
  {
20
  "epoch": 0.01,
21
+ "grad_norm": 2.230577230453491,
22
+ "learning_rate": 5.34e-06,
23
+ "loss": 7.3708349609375,
24
  "step": 100
25
  },
26
  {
27
  "epoch": 0.015,
28
+ "grad_norm": 2.9674696922302246,
29
+ "learning_rate": 8.040000000000001e-06,
30
+ "loss": 6.394255981445313,
31
  "step": 150
32
  },
33
  {
34
  "epoch": 0.02,
35
+ "grad_norm": 5.306502819061279,
36
+ "learning_rate": 1.074e-05,
37
+ "loss": 6.023402709960937,
38
  "step": 200
39
  },
40
  {
41
  "epoch": 0.025,
42
+ "grad_norm": 4.985537528991699,
43
+ "learning_rate": 1.3500000000000001e-05,
44
+ "loss": 6.261904907226563,
45
  "step": 250
46
  },
47
  {
48
  "epoch": 0.03,
49
+ "grad_norm": 3.5350327491760254,
50
+ "learning_rate": 1.65e-05,
51
+ "loss": 5.984814453125,
52
  "step": 300
53
  },
54
  {
55
  "epoch": 0.035,
56
+ "grad_norm": 2.3650736808776855,
57
+ "learning_rate": 1.95e-05,
58
+ "loss": 5.866536865234375,
59
  "step": 350
60
  },
61
  {
62
  "epoch": 0.04,
63
+ "grad_norm": 2.358975410461426,
64
+ "learning_rate": 2.25e-05,
65
+ "loss": 6.0157708740234375,
66
  "step": 400
67
  },
68
  {
69
  "epoch": 0.045,
70
+ "grad_norm": 2.671454429626465,
71
+ "learning_rate": 2.55e-05,
72
+ "loss": 6.32117919921875,
73
  "step": 450
74
  },
75
  {
76
  "epoch": 0.05,
77
+ "grad_norm": 2.476318359375,
78
+ "learning_rate": 2.8499999999999998e-05,
79
+ "loss": 6.613551025390625,
80
  "step": 500
81
  }
82
  ],
last-checkpoint/training_args.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:225acaab3a1a242c2547c8df2938f709d9aa8d25d7392a8bfbd69b716ce99f83
3
  size 5329
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:8218109d1326f8c1ac6726090711a5aba11863a6b5c0e468b0d65fe929b9028b
3
  size 5329