Dikshan1234 commited on
Commit
243a09f
·
verified ·
1 Parent(s): 362d990

checkpoint-23000 | step 23000 | loss 0.3085 | 57.5% complete

Browse files
.gitattributes CHANGED
@@ -74,3 +74,4 @@ checkpoint-20000/tokenizer.json filter=lfs diff=lfs merge=lfs -text
74
  checkpoint-21000/tokenizer.json filter=lfs diff=lfs merge=lfs -text
75
  checkpoint-21404/tokenizer.json filter=lfs diff=lfs merge=lfs -text
76
  checkpoint-22000/tokenizer.json filter=lfs diff=lfs merge=lfs -text
 
 
74
  checkpoint-21000/tokenizer.json filter=lfs diff=lfs merge=lfs -text
75
  checkpoint-21404/tokenizer.json filter=lfs diff=lfs merge=lfs -text
76
  checkpoint-22000/tokenizer.json filter=lfs diff=lfs merge=lfs -text
77
+ checkpoint-23000/tokenizer.json filter=lfs diff=lfs merge=lfs -text
checkpoint-23000/README.md ADDED
@@ -0,0 +1,564 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ # ScriptSwiftAI v12 (Dikshan)
2
+
3
+ > QLoRA fine-tuned full-stack code generation model by **Dikshan** (India).
4
+ > Covers Python, Django, Flask, FastAPI, React, Next.js, TypeScript, SQL, Docker.
5
+
6
+ ---
7
+
8
+ ## License
9
+
10
+ **CC BY-NC 4.0** — Non-commercial use only. Must credit Dikshan / ScriptSwiftAI.
11
+ https://creativecommons.org/licenses/by-nc/4.0/
12
+
13
+ **Copyright © 2026 Dikshan. All rights reserved.**
14
+
15
+ ---
16
+
17
+ ## Model Details
18
+
19
+ | Property | Value |
20
+ |---|---|
21
+ | **Base Model** | Qwen2.5-Coder-7B-Instruct |
22
+ | **Method** | QLoRA (4-bit, r=64) |
23
+ | **Hardware** | NVIDIA RTX 5070 Ti 16GB |
24
+ | **Target Steps** | 40,000 |
25
+ | **Dataset** | ~450-500k samples (17 datasets) |
26
+ | **Max Length** | 1536 tokens |
27
+ | **Developer** | Dikshan (India) |
28
+ | **Training Started** | June 2026 |
29
+
30
+ ---
31
+
32
+ ## Changelog / Training Timeline
33
+
34
+ *Auto-updated by train_v12.py on every checkpoint save.*
35
+ *Append-only — entries never overwritten. HuggingFace commit history provides timestamps.*
36
+
37
+
38
+ ---
39
+
40
+ ### 🔵 Checkpoint — Step 13
41
+ **Date:** June 22, 2026 at 18:44 IST
42
+ **Checkpoint:** checkpoint-13
43
+ **Step:** 13 / 40,000 (0.0% complete)
44
+ **Loss:** 0.6164
45
+ **Epoch:** 0.000
46
+ **Zone:** 📚 Learning
47
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
48
+
49
+ ---
50
+
51
+ ### 🔵 Checkpoint — Step 25
52
+ **Date:** June 22, 2026 at 18:50 IST
53
+ **Checkpoint:** checkpoint-25
54
+ **Step:** 25 / 40,000 (0.1% complete)
55
+ **Loss:** 0.6057
56
+ **Epoch:** 0.001
57
+ **Zone:** 📚 Learning
58
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
59
+
60
+ ---
61
+
62
+ ### 🔵 Checkpoint — Step 36
63
+ **Date:** June 22, 2026 at 18:58 IST
64
+ **Checkpoint:** checkpoint-36
65
+ **Step:** 36 / 40,000 (0.1% complete)
66
+ **Loss:** 0.5508
67
+ **Epoch:** 0.001
68
+ **Zone:** 📚 Learning
69
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
70
+
71
+ ---
72
+
73
+ ### 🔵 Checkpoint — Step 42
74
+ **Date:** June 22, 2026 at 19:08 IST
75
+ **Checkpoint:** checkpoint-42
76
+ **Step:** 42 / 40,000 (0.1% complete)
77
+ **Loss:** 0.5525
78
+ **Epoch:** 0.001
79
+ **Zone:** 📚 Learning
80
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
81
+
82
+ ---
83
+
84
+ ### 🔵 Checkpoint — Step 538
85
+ **Date:** June 22, 2026 at 23:38 IST
86
+ **Checkpoint:** checkpoint-538
87
+ **Step:** 538 / 40,000 (1.3% complete)
88
+ **Loss:** 0.4087
89
+ **Epoch:** 0.015
90
+ **Zone:** 📈 Good
91
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
92
+
93
+ ---
94
+
95
+ ### 🔵 Checkpoint — Step 1,000
96
+ **Date:** June 23, 2026 at 03:05 IST
97
+ **Checkpoint:** checkpoint-1000
98
+ **Step:** 1,000 / 40,000 (2.5% complete)
99
+ **Loss:** 0.4174
100
+ **Epoch:** 0.029
101
+ **Zone:** 📈 Good
102
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
103
+
104
+ ---
105
+
106
+ ### 🔵 Checkpoint — Step 1,797
107
+ **Date:** June 23, 2026 at 08:26 IST
108
+ **Checkpoint:** checkpoint-1797
109
+ **Step:** 1,797 / 40,000 (4.5% complete)
110
+ **Loss:** 0.3927
111
+ **Epoch:** 0.052
112
+ **Zone:** 📈 Good
113
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
114
+
115
+ ---
116
+
117
+ ### 🔵 Checkpoint — Step 2,000
118
+ **Date:** June 23, 2026 at 09:52 IST
119
+ **Checkpoint:** checkpoint-2000
120
+ **Step:** 2,000 / 40,000 (5.0% complete)
121
+ **Loss:** 0.4383
122
+ **Epoch:** 0.058
123
+ **Zone:** 📈 Good
124
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
125
+
126
+ ---
127
+
128
+ ### 🔵 Checkpoint — Step 3,000
129
+ **Date:** June 23, 2026 at 17:35 IST
130
+ **Checkpoint:** checkpoint-3000
131
+ **Step:** 3,000 / 40,000 (7.5% complete)
132
+ **Loss:** 0.4153
133
+ **Epoch:** 0.088
134
+ **Zone:** 📈 Good
135
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
136
+
137
+ ---
138
+
139
+ ### 🔵 Checkpoint — Step 3,876
140
+ **Date:** June 23, 2026 at 23:40 IST
141
+ **Checkpoint:** checkpoint-3876
142
+ **Step:** 3,876 / 40,000 (9.7% complete)
143
+ **Loss:** 0.3439
144
+ **Epoch:** 0.113
145
+ **Zone:** 📈 Good
146
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
147
+
148
+ ---
149
+
150
+ ### 🔵 Checkpoint — Step 4,000
151
+ **Date:** June 24, 2026 at 00:54 IST
152
+ **Checkpoint:** checkpoint-4000
153
+ **Step:** 4,000 / 40,000 (10.0% complete)
154
+ **Loss:** 0.3980
155
+ **Epoch:** 0.117
156
+ **Zone:** 📈 Good
157
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
158
+
159
+ ---
160
+
161
+ ### 🔵 Checkpoint — Step 5,000
162
+ **Date:** June 24, 2026 at 07:38 IST
163
+ **Checkpoint:** checkpoint-5000
164
+ **Step:** 5,000 / 40,000 (12.5% complete)
165
+ **Loss:** 0.2748
166
+ **Epoch:** 0.146
167
+ **Zone:** 📈 Good
168
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
169
+
170
+ ---
171
+
172
+ ### 🔵 Checkpoint — Step 6,000
173
+ **Date:** June 24, 2026 at 14:22 IST
174
+ **Checkpoint:** checkpoint-6000
175
+ **Step:** 6,000 / 40,000 (15.0% complete)
176
+ **Loss:** 0.2319
177
+ **Epoch:** 0.175
178
+ **Zone:** 🎯 Sweet Spot
179
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
180
+
181
+ ---
182
+
183
+ ### 🔵 Checkpoint — Step 6,326
184
+ **Date:** June 24, 2026 at 19:59 IST
185
+ **Checkpoint:** checkpoint-6326
186
+ **Step:** 6,326 / 40,000 (15.8% complete)
187
+ **Loss:** 0.2695
188
+ **Epoch:** 0.185
189
+ **Zone:** 📈 Good
190
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
191
+
192
+ ---
193
+
194
+ ### 🔵 Checkpoint — Step 6,739
195
+ **Date:** June 24, 2026 at 23:37 IST
196
+ **Checkpoint:** checkpoint-6739
197
+ **Step:** 6,739 / 40,000 (16.8% complete)
198
+ **Loss:** 0.1934
199
+ **Epoch:** 0.197
200
+ **Zone:** 🎯 Sweet Spot
201
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
202
+
203
+ ---
204
+
205
+ ### 🔵 Checkpoint — Step 7,000
206
+ **Date:** June 25, 2026 at 02:24 IST
207
+ **Checkpoint:** checkpoint-7000
208
+ **Step:** 7,000 / 40,000 (17.5% complete)
209
+ **Loss:** 0.1105
210
+ **Epoch:** 0.205
211
+ **Zone:** ⚠️ Overfit Risk
212
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
213
+
214
+ ---
215
+
216
+ ### 🔵 Checkpoint — Step 8,000
217
+ **Date:** June 25, 2026 at 09:05 IST
218
+ **Checkpoint:** checkpoint-8000
219
+ **Step:** 8,000 / 40,000 (20.0% complete)
220
+ **Loss:** 0.2105
221
+ **Epoch:** 0.234
222
+ **Zone:** 🎯 Sweet Spot
223
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
224
+
225
+ ---
226
+
227
+ ### 🔵 Checkpoint — Step 8,978
228
+ **Date:** June 25, 2026 at 15:38 IST
229
+ **Checkpoint:** checkpoint-8978
230
+ **Step:** 8,978 / 40,000 (22.4% complete)
231
+ **Loss:** 0.3111
232
+ **Epoch:** 0.262
233
+ **Zone:** 📈 Good
234
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
235
+
236
+ ---
237
+
238
+ ### 🔵 Checkpoint — Step 9,000
239
+ **Date:** June 25, 2026 at 15:47 IST
240
+ **Checkpoint:** checkpoint-9000
241
+ **Step:** 9,000 / 40,000 (22.5% complete)
242
+ **Loss:** 0.3143
243
+ **Epoch:** 0.263
244
+ **Zone:** 📈 Good
245
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
246
+
247
+ ---
248
+
249
+ ### 🔵 Checkpoint — Step 9,090
250
+ **Date:** June 25, 2026 at 16:29 IST
251
+ **Checkpoint:** checkpoint-9090
252
+ **Step:** 9,090 / 40,000 (22.7% complete)
253
+ **Loss:** 0.3586
254
+ **Epoch:** 0.266
255
+ **Zone:** 📈 Good
256
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
257
+
258
+ ---
259
+
260
+ ### 🔵 Checkpoint — Step 9,718
261
+ **Date:** June 25, 2026 at 21:33 IST
262
+ **Checkpoint:** checkpoint-9718
263
+ **Step:** 9,718 / 40,000 (24.3% complete)
264
+ **Loss:** 0.2998
265
+ **Epoch:** 0.284
266
+ **Zone:** 📈 Good
267
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
268
+
269
+ ---
270
+
271
+ ### 🔵 Checkpoint — Step 9,942
272
+ **Date:** June 25, 2026 at 23:59 IST
273
+ **Checkpoint:** checkpoint-9942
274
+ **Step:** 9,942 / 40,000 (24.9% complete)
275
+ **Loss:** 0.2736
276
+ **Epoch:** 0.291
277
+ **Zone:** 📈 Good
278
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
279
+
280
+ ---
281
+
282
+ ### 🔵 Checkpoint — Step 10,000
283
+ **Date:** June 26, 2026 at 00:23 IST
284
+ **Checkpoint:** checkpoint-10000
285
+ **Step:** 10,000 / 40,000 (25.0% complete)
286
+ **Loss:** 0.2685
287
+ **Epoch:** 0.292
288
+ **Zone:** 📈 Good
289
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
290
+
291
+ ---
292
+
293
+ ### 🔵 Checkpoint — Step 11,000
294
+ **Date:** June 26, 2026 at 07:17 IST
295
+ **Checkpoint:** checkpoint-11000
296
+ **Step:** 11,000 / 40,000 (27.5% complete)
297
+ **Loss:** 0.4008
298
+ **Epoch:** 0.322
299
+ **Zone:** 📈 Good
300
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
301
+
302
+ ---
303
+
304
+ ### 🔵 Checkpoint — Step 12,000
305
+ **Date:** June 26, 2026 at 14:10 IST
306
+ **Checkpoint:** checkpoint-12000
307
+ **Step:** 12,000 / 40,000 (30.0% complete)
308
+ **Loss:** 0.3562
309
+ **Epoch:** 0.351
310
+ **Zone:** 📈 Good
311
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
312
+
313
+ ---
314
+
315
+ ### 🔵 Checkpoint — Step 12,694
316
+ **Date:** June 26, 2026 at 19:36 IST
317
+ **Checkpoint:** checkpoint-12694
318
+ **Step:** 12,694 / 40,000 (31.7% complete)
319
+ **Loss:** 0.3882
320
+ **Epoch:** 0.371
321
+ **Zone:** 📈 Good
322
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
323
+
324
+ ---
325
+
326
+ ### 🔵 Checkpoint — Step 12,793
327
+ **Date:** June 26, 2026 at 20:50 IST
328
+ **Checkpoint:** checkpoint-12793
329
+ **Step:** 12,793 / 40,000 (32.0% complete)
330
+ **Loss:** 0.2054
331
+ **Epoch:** 0.374
332
+ **Zone:** 🎯 Sweet Spot
333
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
334
+
335
+ ---
336
+
337
+ ### 🔵 Checkpoint — Step 13,000
338
+ **Date:** June 26, 2026 at 22:14 IST
339
+ **Checkpoint:** checkpoint-13000
340
+ **Step:** 13,000 / 40,000 (32.5% complete)
341
+ **Loss:** 0.2178
342
+ **Epoch:** 0.380
343
+ **Zone:** 🎯 Sweet Spot
344
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
345
+
346
+ ---
347
+
348
+ ### 🔵 Checkpoint — Step 14,000
349
+ **Date:** June 27, 2026 at 05:20 IST
350
+ **Checkpoint:** checkpoint-14000
351
+ **Step:** 14,000 / 40,000 (35.0% complete)
352
+ **Loss:** 0.2634
353
+ **Epoch:** 0.409
354
+ **Zone:** 📈 Good
355
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
356
+
357
+ ---
358
+
359
+ ### 🔵 Checkpoint — Step 14,769
360
+ **Date:** June 27, 2026 at 10:48 IST
361
+ **Checkpoint:** checkpoint-14769
362
+ **Step:** 14,769 / 40,000 (36.9% complete)
363
+ **Loss:** 0.1741
364
+ **Epoch:** 0.431
365
+ **Zone:** 🎯 Sweet Spot
366
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
367
+
368
+ ---
369
+
370
+ ### 🔵 Checkpoint — Step 14,907
371
+ **Date:** June 27, 2026 at 12:34 IST
372
+ **Checkpoint:** checkpoint-14907
373
+ **Step:** 14,907 / 40,000 (37.3% complete)
374
+ **Loss:** 0.2403
375
+ **Epoch:** 0.436
376
+ **Zone:** 🎯 Sweet Spot
377
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
378
+
379
+ ---
380
+
381
+ ### 🔵 Checkpoint — Step 15,000
382
+ **Date:** June 27, 2026 at 13:25 IST
383
+ **Checkpoint:** checkpoint-15000
384
+ **Step:** 15,000 / 40,000 (37.5% complete)
385
+ **Loss:** 0.2500
386
+ **Epoch:** 0.438
387
+ **Zone:** 📈 Good
388
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
389
+
390
+ ---
391
+
392
+ ### 🔵 Checkpoint — Step 15,176
393
+ **Date:** June 27, 2026 at 16:14 IST
394
+ **Checkpoint:** checkpoint-15176
395
+ **Step:** 15,176 / 40,000 (37.9% complete)
396
+ **Loss:** 0.1106
397
+ **Epoch:** 0.443
398
+ **Zone:** ⚠️ Overfit Risk
399
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
400
+
401
+ ---
402
+
403
+ ### 🔵 Checkpoint — Step 15,215
404
+ **Date:** June 27, 2026 at 16:31 IST
405
+ **Checkpoint:** checkpoint-15215
406
+ **Step:** 15,215 / 40,000 (38.0% complete)
407
+ **Loss:** 0.1262
408
+ **Epoch:** 0.445
409
+ **Zone:** 🎯 Sweet Spot
410
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
411
+
412
+ ---
413
+
414
+ ### 🔵 Checkpoint — Step 15,743
415
+ **Date:** June 27, 2026 at 20:14 IST
416
+ **Checkpoint:** checkpoint-15743
417
+ **Step:** 15,743 / 40,000 (39.4% complete)
418
+ **Loss:** 0.1310
419
+ **Epoch:** 0.460
420
+ **Zone:** 🎯 Sweet Spot
421
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
422
+
423
+ ---
424
+
425
+ ### 🔵 Checkpoint — Step 16,000
426
+ **Date:** June 27, 2026 at 22:07 IST
427
+ **Checkpoint:** checkpoint-16000
428
+ **Step:** 16,000 / 40,000 (40.0% complete)
429
+ **Loss:** 0.1250
430
+ **Epoch:** 0.468
431
+ **Zone:** 🎯 Sweet Spot
432
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
433
+
434
+ ---
435
+
436
+ ### 🔵 Checkpoint — Step 16,053
437
+ **Date:** June 27, 2026 at 23:06 IST
438
+ **Checkpoint:** checkpoint-16053
439
+ **Step:** 16,053 / 40,000 (40.1% complete)
440
+ **Loss:** 0.1144
441
+ **Epoch:** 0.469
442
+ **Zone:** ⚠️ Overfit Risk
443
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
444
+
445
+ ---
446
+
447
+ ### 🔵 Checkpoint — Step 16,148
448
+ **Date:** June 28, 2026 at 00:24 IST
449
+ **Checkpoint:** checkpoint-16148
450
+ **Step:** 16,148 / 40,000 (40.4% complete)
451
+ **Loss:** 0.1240
452
+ **Epoch:** 0.472
453
+ **Zone:** 🎯 Sweet Spot
454
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
455
+
456
+ ---
457
+
458
+ ### 🔵 Checkpoint — Step 17,000
459
+ **Date:** June 28, 2026 at 06:13 IST
460
+ **Checkpoint:** checkpoint-17000
461
+ **Step:** 17,000 / 40,000 (42.5% complete)
462
+ **Loss:** 0.1117
463
+ **Epoch:** 0.497
464
+ **Zone:** ⚠️ Overfit Risk
465
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
466
+
467
+ ---
468
+
469
+ ### 🔵 Checkpoint — Step 17,594
470
+ **Date:** June 28, 2026 at 10:16 IST
471
+ **Checkpoint:** checkpoint-17594
472
+ **Step:** 17,594 / 40,000 (44.0% complete)
473
+ **Loss:** 0.2489
474
+ **Epoch:** 0.514
475
+ **Zone:** 🎯 Sweet Spot
476
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
477
+
478
+ ---
479
+
480
+ ### 🔵 Checkpoint — Step 18,000
481
+ **Date:** June 28, 2026 at 18:25 IST
482
+ **Checkpoint:** checkpoint-18000
483
+ **Step:** 18,000 / 40,000 (45.0% complete)
484
+ **Loss:** 0.0850
485
+ **Epoch:** 0.526
486
+ **Zone:** ⚠️ Overfit Risk
487
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
488
+
489
+ ---
490
+
491
+ ### 🔵 Checkpoint — Step 18,594
492
+ **Date:** June 28, 2026 at 22:39 IST
493
+ **Checkpoint:** checkpoint-18594
494
+ **Step:** 18,594 / 40,000 (46.5% complete)
495
+ **Loss:** 0.0885
496
+ **Epoch:** 0.543
497
+ **Zone:** ⚠️ Overfit Risk
498
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
499
+
500
+ ---
501
+
502
+ ### 🔵 Checkpoint — Step 19,000
503
+ **Date:** June 29, 2026 at 02:10 IST
504
+ **Checkpoint:** checkpoint-19000
505
+ **Step:** 19,000 / 40,000 (47.5% complete)
506
+ **Loss:** 0.0535
507
+ **Epoch:** 0.555
508
+ **Zone:** ⚠️ Overfit Risk
509
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
510
+
511
+ ---
512
+
513
+ ### 🔵 Checkpoint — Step 20,000
514
+ **Date:** June 29, 2026 at 08:56 IST
515
+ **Checkpoint:** checkpoint-20000
516
+ **Step:** 20,000 / 40,000 (50.0% complete)
517
+ **Loss:** 0.1070
518
+ **Epoch:** 0.585
519
+ **Zone:** ⚠️ Overfit Risk
520
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
521
+
522
+ ---
523
+
524
+ ### 🔵 Checkpoint — Step 21,000
525
+ **Date:** June 29, 2026 at 15:45 IST
526
+ **Checkpoint:** checkpoint-21000
527
+ **Step:** 21,000 / 40,000 (52.5% complete)
528
+ **Loss:** 0.1521
529
+ **Epoch:** 0.614
530
+ **Zone:** 🎯 Sweet Spot
531
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
532
+
533
+ ---
534
+
535
+ ### 🔵 Checkpoint — Step 21,404
536
+ **Date:** June 29, 2026 at 18:52 IST
537
+ **Checkpoint:** checkpoint-21404
538
+ **Step:** 21,404 / 40,000 (53.5% complete)
539
+ **Loss:** 0.2434
540
+ **Epoch:** 0.625
541
+ **Zone:** 🎯 Sweet Spot
542
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
543
+
544
+ ---
545
+
546
+ ### 🔵 Checkpoint — Step 22,000
547
+ **Date:** June 30, 2026 at 00:08 IST
548
+ **Checkpoint:** checkpoint-22000
549
+ **Step:** 22,000 / 40,000 (55.0% complete)
550
+ **Loss:** 0.2471
551
+ **Epoch:** 0.643
552
+ **Zone:** 🎯 Sweet Spot
553
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
554
+
555
+ ---
556
+
557
+ ### 🔵 Checkpoint — Step 23,000
558
+ **Date:** June 30, 2026 at 07:12 IST
559
+ **Checkpoint:** checkpoint-23000
560
+ **Step:** 23,000 / 40,000 (57.5% complete)
561
+ **Loss:** 0.3085
562
+ **Epoch:** 0.672
563
+ **Zone:** 📈 Good
564
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
checkpoint-23000/adapter_config.json ADDED
@@ -0,0 +1,48 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "alora_invocation_tokens": null,
3
+ "alpha_pattern": {},
4
+ "arrow_config": null,
5
+ "auto_mapping": null,
6
+ "base_model_name_or_path": "Qwen/Qwen2.5-Coder-7B-Instruct",
7
+ "bias": "none",
8
+ "corda_config": null,
9
+ "ensure_weight_tying": false,
10
+ "eva_config": null,
11
+ "exclude_modules": null,
12
+ "fan_in_fan_out": false,
13
+ "inference_mode": true,
14
+ "init_lora_weights": true,
15
+ "layer_replication": null,
16
+ "layers_pattern": null,
17
+ "layers_to_transform": null,
18
+ "loftq_config": {},
19
+ "lora_alpha": 128,
20
+ "lora_bias": false,
21
+ "lora_dropout": 0.05,
22
+ "lora_ga_config": null,
23
+ "megatron_config": null,
24
+ "megatron_core": "megatron.core",
25
+ "modules_to_save": null,
26
+ "peft_type": "LORA",
27
+ "peft_version": "0.19.1",
28
+ "qalora_group_size": 16,
29
+ "r": 64,
30
+ "rank_pattern": {},
31
+ "revision": null,
32
+ "target_modules": [
33
+ "k_proj",
34
+ "up_proj",
35
+ "gate_proj",
36
+ "v_proj",
37
+ "o_proj",
38
+ "q_proj",
39
+ "down_proj"
40
+ ],
41
+ "target_parameters": null,
42
+ "task_type": "CAUSAL_LM",
43
+ "trainable_token_indices": null,
44
+ "use_bdlora": null,
45
+ "use_dora": false,
46
+ "use_qalora": false,
47
+ "use_rslora": false
48
+ }
checkpoint-23000/adapter_model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e007a3c7b2dbea248ace822ff1564677f0d7d9df84379311c75b855ae3daa703
3
+ size 645975704
checkpoint-23000/chat_template.jinja ADDED
@@ -0,0 +1,54 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {%- if tools %}
2
+ {{- '<|im_start|>system\n' }}
3
+ {%- if messages[0]['role'] == 'system' %}
4
+ {{- messages[0]['content'] }}
5
+ {%- else %}
6
+ {{- 'You are Qwen, created by Alibaba Cloud. You are a helpful assistant.' }}
7
+ {%- endif %}
8
+ {{- "\n\n# Tools\n\nYou may call one or more functions to assist with the user query.\n\nYou are provided with function signatures within <tools></tools> XML tags:\n<tools>" }}
9
+ {%- for tool in tools %}
10
+ {{- "\n" }}
11
+ {{- tool | tojson }}
12
+ {%- endfor %}
13
+ {{- "\n</tools>\n\nFor each function call, return a json object with function name and arguments within <tool_call></tool_call> XML tags:\n<tool_call>\n{\"name\": <function-name>, \"arguments\": <args-json-object>}\n</tool_call><|im_end|>\n" }}
14
+ {%- else %}
15
+ {%- if messages[0]['role'] == 'system' %}
16
+ {{- '<|im_start|>system\n' + messages[0]['content'] + '<|im_end|>\n' }}
17
+ {%- else %}
18
+ {{- '<|im_start|>system\nYou are Qwen, created by Alibaba Cloud. You are a helpful assistant.<|im_end|>\n' }}
19
+ {%- endif %}
20
+ {%- endif %}
21
+ {%- for message in messages %}
22
+ {%- if (message.role == "user") or (message.role == "system" and not loop.first) or (message.role == "assistant" and not message.tool_calls) %}
23
+ {{- '<|im_start|>' + message.role + '\n' + message.content + '<|im_end|>' + '\n' }}
24
+ {%- elif message.role == "assistant" %}
25
+ {{- '<|im_start|>' + message.role }}
26
+ {%- if message.content %}
27
+ {{- '\n' + message.content }}
28
+ {%- endif %}
29
+ {%- for tool_call in message.tool_calls %}
30
+ {%- if tool_call.function is defined %}
31
+ {%- set tool_call = tool_call.function %}
32
+ {%- endif %}
33
+ {{- '\n<tool_call>\n{"name": "' }}
34
+ {{- tool_call.name }}
35
+ {{- '", "arguments": ' }}
36
+ {{- tool_call.arguments | tojson }}
37
+ {{- '}\n</tool_call>' }}
38
+ {%- endfor %}
39
+ {{- '<|im_end|>\n' }}
40
+ {%- elif message.role == "tool" %}
41
+ {%- if (loop.index0 == 0) or (messages[loop.index0 - 1].role != "tool") %}
42
+ {{- '<|im_start|>user' }}
43
+ {%- endif %}
44
+ {{- '\n<tool_response>\n' }}
45
+ {{- message.content }}
46
+ {{- '\n</tool_response>' }}
47
+ {%- if loop.last or (messages[loop.index0 + 1].role != "tool") %}
48
+ {{- '<|im_end|>\n' }}
49
+ {%- endif %}
50
+ {%- endif %}
51
+ {%- endfor %}
52
+ {%- if add_generation_prompt %}
53
+ {{- '<|im_start|>assistant\n' }}
54
+ {%- endif %}
checkpoint-23000/optimizer.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:2a0c43ebd94e31814c69a2b9ee6efa81c90183bec497b6eb0284ee188257a03b
3
+ size 329492947
checkpoint-23000/rng_state.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e6163f036abf2e7d24733e9c3de95c74502246c518f0d52d702e2f0fdff26a6d
3
+ size 14645
checkpoint-23000/scheduler.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:0ae1d6f80f9f7c1e58866ec669801eaa1d61b9ac77986d3ca9be3a9769cafc4c
3
+ size 1465
checkpoint-23000/tokenizer.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3fd169731d2cbde95e10bf356d66d5997fd885dd8dbb6fb4684da3f23b2585d8
3
+ size 11421892
checkpoint-23000/tokenizer_config.json ADDED
@@ -0,0 +1,30 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "add_prefix_space": false,
3
+ "backend": "tokenizers",
4
+ "bos_token": null,
5
+ "clean_up_tokenization_spaces": false,
6
+ "eos_token": "<|im_end|>",
7
+ "errors": "replace",
8
+ "extra_special_tokens": [
9
+ "<|im_start|>",
10
+ "<|im_end|>",
11
+ "<|object_ref_start|>",
12
+ "<|object_ref_end|>",
13
+ "<|box_start|>",
14
+ "<|box_end|>",
15
+ "<|quad_start|>",
16
+ "<|quad_end|>",
17
+ "<|vision_start|>",
18
+ "<|vision_end|>",
19
+ "<|vision_pad|>",
20
+ "<|image_pad|>",
21
+ "<|video_pad|>"
22
+ ],
23
+ "is_local": false,
24
+ "local_files_only": false,
25
+ "model_max_length": 32768,
26
+ "pad_token": "<|im_end|>",
27
+ "split_special_tokens": false,
28
+ "tokenizer_class": "Qwen2Tokenizer",
29
+ "unk_token": null
30
+ }
checkpoint-23000/trainer_state.json ADDED
The diff for this file is too large to render. See raw diff
 
checkpoint-23000/training_args.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e6ab51bd599651344f26a67a1d940a2b6432da90051bdf388dcef2423ea1342d
3
+ size 5329