Dikshan1234 commited on
Commit
5d99634
·
verified ·
1 Parent(s): fc854c1

checkpoint-39932 | step 39932 | loss 0.0000 | 99.8% complete

Browse files
.gitattributes CHANGED
@@ -96,3 +96,4 @@ checkpoint-37002/tokenizer.json filter=lfs diff=lfs merge=lfs -text
96
  checkpoint-38001/tokenizer.json filter=lfs diff=lfs merge=lfs -text
97
  checkpoint-38195/tokenizer.json filter=lfs diff=lfs merge=lfs -text
98
  checkpoint-39000/tokenizer.json filter=lfs diff=lfs merge=lfs -text
 
 
96
  checkpoint-38001/tokenizer.json filter=lfs diff=lfs merge=lfs -text
97
  checkpoint-38195/tokenizer.json filter=lfs diff=lfs merge=lfs -text
98
  checkpoint-39000/tokenizer.json filter=lfs diff=lfs merge=lfs -text
99
+ checkpoint-39932/tokenizer.json filter=lfs diff=lfs merge=lfs -text
checkpoint-39932/README.md ADDED
@@ -0,0 +1,894 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ # ScriptSwiftAI v12 (Dikshan)
2
+
3
+ > QLoRA fine-tuned full-stack code generation model by **Dikshan** (India).
4
+ > Covers Python, Django, Flask, FastAPI, React, Next.js, TypeScript, SQL, Docker.
5
+
6
+ ---
7
+
8
+ ## License
9
+
10
+ **CC BY-NC 4.0** — Non-commercial use only. Must credit Dikshan / ScriptSwiftAI.
11
+ https://creativecommons.org/licenses/by-nc/4.0/
12
+
13
+ **Copyright © 2026 Dikshan. All rights reserved.**
14
+
15
+ ---
16
+
17
+ ## Model Details
18
+
19
+ | Property | Value |
20
+ |---|---|
21
+ | **Base Model** | Qwen2.5-Coder-7B-Instruct |
22
+ | **Method** | QLoRA (4-bit, r=64) |
23
+ | **Hardware** | NVIDIA RTX 5070 Ti 16GB |
24
+ | **Target Steps** | 40,000 |
25
+ | **Dataset** | ~450-500k samples (17 datasets) |
26
+ | **Max Length** | 1536 tokens |
27
+ | **Developer** | Dikshan (India) |
28
+ | **Training Started** | June 2026 |
29
+
30
+ ---
31
+
32
+ ## Changelog / Training Timeline
33
+
34
+ *Auto-updated by train_v12.py on every checkpoint save.*
35
+ *Append-only — entries never overwritten. HuggingFace commit history provides timestamps.*
36
+
37
+
38
+ ---
39
+
40
+ ### 🔵 Checkpoint — Step 13
41
+ **Date:** June 22, 2026 at 18:44 IST
42
+ **Checkpoint:** checkpoint-13
43
+ **Step:** 13 / 40,000 (0.0% complete)
44
+ **Loss:** 0.6164
45
+ **Epoch:** 0.000
46
+ **Zone:** 📚 Learning
47
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
48
+
49
+ ---
50
+
51
+ ### 🔵 Checkpoint — Step 25
52
+ **Date:** June 22, 2026 at 18:50 IST
53
+ **Checkpoint:** checkpoint-25
54
+ **Step:** 25 / 40,000 (0.1% complete)
55
+ **Loss:** 0.6057
56
+ **Epoch:** 0.001
57
+ **Zone:** 📚 Learning
58
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
59
+
60
+ ---
61
+
62
+ ### 🔵 Checkpoint — Step 36
63
+ **Date:** June 22, 2026 at 18:58 IST
64
+ **Checkpoint:** checkpoint-36
65
+ **Step:** 36 / 40,000 (0.1% complete)
66
+ **Loss:** 0.5508
67
+ **Epoch:** 0.001
68
+ **Zone:** 📚 Learning
69
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
70
+
71
+ ---
72
+
73
+ ### 🔵 Checkpoint — Step 42
74
+ **Date:** June 22, 2026 at 19:08 IST
75
+ **Checkpoint:** checkpoint-42
76
+ **Step:** 42 / 40,000 (0.1% complete)
77
+ **Loss:** 0.5525
78
+ **Epoch:** 0.001
79
+ **Zone:** 📚 Learning
80
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
81
+
82
+ ---
83
+
84
+ ### 🔵 Checkpoint — Step 538
85
+ **Date:** June 22, 2026 at 23:38 IST
86
+ **Checkpoint:** checkpoint-538
87
+ **Step:** 538 / 40,000 (1.3% complete)
88
+ **Loss:** 0.4087
89
+ **Epoch:** 0.015
90
+ **Zone:** 📈 Good
91
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
92
+
93
+ ---
94
+
95
+ ### 🔵 Checkpoint — Step 1,000
96
+ **Date:** June 23, 2026 at 03:05 IST
97
+ **Checkpoint:** checkpoint-1000
98
+ **Step:** 1,000 / 40,000 (2.5% complete)
99
+ **Loss:** 0.4174
100
+ **Epoch:** 0.029
101
+ **Zone:** 📈 Good
102
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
103
+
104
+ ---
105
+
106
+ ### 🔵 Checkpoint — Step 1,797
107
+ **Date:** June 23, 2026 at 08:26 IST
108
+ **Checkpoint:** checkpoint-1797
109
+ **Step:** 1,797 / 40,000 (4.5% complete)
110
+ **Loss:** 0.3927
111
+ **Epoch:** 0.052
112
+ **Zone:** 📈 Good
113
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
114
+
115
+ ---
116
+
117
+ ### 🔵 Checkpoint — Step 2,000
118
+ **Date:** June 23, 2026 at 09:52 IST
119
+ **Checkpoint:** checkpoint-2000
120
+ **Step:** 2,000 / 40,000 (5.0% complete)
121
+ **Loss:** 0.4383
122
+ **Epoch:** 0.058
123
+ **Zone:** 📈 Good
124
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
125
+
126
+ ---
127
+
128
+ ### 🔵 Checkpoint — Step 3,000
129
+ **Date:** June 23, 2026 at 17:35 IST
130
+ **Checkpoint:** checkpoint-3000
131
+ **Step:** 3,000 / 40,000 (7.5% complete)
132
+ **Loss:** 0.4153
133
+ **Epoch:** 0.088
134
+ **Zone:** 📈 Good
135
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
136
+
137
+ ---
138
+
139
+ ### 🔵 Checkpoint — Step 3,876
140
+ **Date:** June 23, 2026 at 23:40 IST
141
+ **Checkpoint:** checkpoint-3876
142
+ **Step:** 3,876 / 40,000 (9.7% complete)
143
+ **Loss:** 0.3439
144
+ **Epoch:** 0.113
145
+ **Zone:** 📈 Good
146
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
147
+
148
+ ---
149
+
150
+ ### 🔵 Checkpoint — Step 4,000
151
+ **Date:** June 24, 2026 at 00:54 IST
152
+ **Checkpoint:** checkpoint-4000
153
+ **Step:** 4,000 / 40,000 (10.0% complete)
154
+ **Loss:** 0.3980
155
+ **Epoch:** 0.117
156
+ **Zone:** 📈 Good
157
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
158
+
159
+ ---
160
+
161
+ ### 🔵 Checkpoint — Step 5,000
162
+ **Date:** June 24, 2026 at 07:38 IST
163
+ **Checkpoint:** checkpoint-5000
164
+ **Step:** 5,000 / 40,000 (12.5% complete)
165
+ **Loss:** 0.2748
166
+ **Epoch:** 0.146
167
+ **Zone:** 📈 Good
168
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
169
+
170
+ ---
171
+
172
+ ### 🔵 Checkpoint — Step 6,000
173
+ **Date:** June 24, 2026 at 14:22 IST
174
+ **Checkpoint:** checkpoint-6000
175
+ **Step:** 6,000 / 40,000 (15.0% complete)
176
+ **Loss:** 0.2319
177
+ **Epoch:** 0.175
178
+ **Zone:** 🎯 Sweet Spot
179
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
180
+
181
+ ---
182
+
183
+ ### 🔵 Checkpoint — Step 6,326
184
+ **Date:** June 24, 2026 at 19:59 IST
185
+ **Checkpoint:** checkpoint-6326
186
+ **Step:** 6,326 / 40,000 (15.8% complete)
187
+ **Loss:** 0.2695
188
+ **Epoch:** 0.185
189
+ **Zone:** 📈 Good
190
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
191
+
192
+ ---
193
+
194
+ ### 🔵 Checkpoint — Step 6,739
195
+ **Date:** June 24, 2026 at 23:37 IST
196
+ **Checkpoint:** checkpoint-6739
197
+ **Step:** 6,739 / 40,000 (16.8% complete)
198
+ **Loss:** 0.1934
199
+ **Epoch:** 0.197
200
+ **Zone:** 🎯 Sweet Spot
201
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
202
+
203
+ ---
204
+
205
+ ### 🔵 Checkpoint — Step 7,000
206
+ **Date:** June 25, 2026 at 02:24 IST
207
+ **Checkpoint:** checkpoint-7000
208
+ **Step:** 7,000 / 40,000 (17.5% complete)
209
+ **Loss:** 0.1105
210
+ **Epoch:** 0.205
211
+ **Zone:** ⚠️ Overfit Risk
212
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
213
+
214
+ ---
215
+
216
+ ### 🔵 Checkpoint — Step 8,000
217
+ **Date:** June 25, 2026 at 09:05 IST
218
+ **Checkpoint:** checkpoint-8000
219
+ **Step:** 8,000 / 40,000 (20.0% complete)
220
+ **Loss:** 0.2105
221
+ **Epoch:** 0.234
222
+ **Zone:** 🎯 Sweet Spot
223
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
224
+
225
+ ---
226
+
227
+ ### 🔵 Checkpoint — Step 8,978
228
+ **Date:** June 25, 2026 at 15:38 IST
229
+ **Checkpoint:** checkpoint-8978
230
+ **Step:** 8,978 / 40,000 (22.4% complete)
231
+ **Loss:** 0.3111
232
+ **Epoch:** 0.262
233
+ **Zone:** 📈 Good
234
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
235
+
236
+ ---
237
+
238
+ ### 🔵 Checkpoint — Step 9,000
239
+ **Date:** June 25, 2026 at 15:47 IST
240
+ **Checkpoint:** checkpoint-9000
241
+ **Step:** 9,000 / 40,000 (22.5% complete)
242
+ **Loss:** 0.3143
243
+ **Epoch:** 0.263
244
+ **Zone:** 📈 Good
245
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
246
+
247
+ ---
248
+
249
+ ### 🔵 Checkpoint — Step 9,090
250
+ **Date:** June 25, 2026 at 16:29 IST
251
+ **Checkpoint:** checkpoint-9090
252
+ **Step:** 9,090 / 40,000 (22.7% complete)
253
+ **Loss:** 0.3586
254
+ **Epoch:** 0.266
255
+ **Zone:** 📈 Good
256
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
257
+
258
+ ---
259
+
260
+ ### 🔵 Checkpoint — Step 9,718
261
+ **Date:** June 25, 2026 at 21:33 IST
262
+ **Checkpoint:** checkpoint-9718
263
+ **Step:** 9,718 / 40,000 (24.3% complete)
264
+ **Loss:** 0.2998
265
+ **Epoch:** 0.284
266
+ **Zone:** 📈 Good
267
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
268
+
269
+ ---
270
+
271
+ ### 🔵 Checkpoint — Step 9,942
272
+ **Date:** June 25, 2026 at 23:59 IST
273
+ **Checkpoint:** checkpoint-9942
274
+ **Step:** 9,942 / 40,000 (24.9% complete)
275
+ **Loss:** 0.2736
276
+ **Epoch:** 0.291
277
+ **Zone:** 📈 Good
278
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
279
+
280
+ ---
281
+
282
+ ### 🔵 Checkpoint — Step 10,000
283
+ **Date:** June 26, 2026 at 00:23 IST
284
+ **Checkpoint:** checkpoint-10000
285
+ **Step:** 10,000 / 40,000 (25.0% complete)
286
+ **Loss:** 0.2685
287
+ **Epoch:** 0.292
288
+ **Zone:** 📈 Good
289
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
290
+
291
+ ---
292
+
293
+ ### 🔵 Checkpoint — Step 11,000
294
+ **Date:** June 26, 2026 at 07:17 IST
295
+ **Checkpoint:** checkpoint-11000
296
+ **Step:** 11,000 / 40,000 (27.5% complete)
297
+ **Loss:** 0.4008
298
+ **Epoch:** 0.322
299
+ **Zone:** 📈 Good
300
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
301
+
302
+ ---
303
+
304
+ ### 🔵 Checkpoint — Step 12,000
305
+ **Date:** June 26, 2026 at 14:10 IST
306
+ **Checkpoint:** checkpoint-12000
307
+ **Step:** 12,000 / 40,000 (30.0% complete)
308
+ **Loss:** 0.3562
309
+ **Epoch:** 0.351
310
+ **Zone:** 📈 Good
311
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
312
+
313
+ ---
314
+
315
+ ### 🔵 Checkpoint — Step 12,694
316
+ **Date:** June 26, 2026 at 19:36 IST
317
+ **Checkpoint:** checkpoint-12694
318
+ **Step:** 12,694 / 40,000 (31.7% complete)
319
+ **Loss:** 0.3882
320
+ **Epoch:** 0.371
321
+ **Zone:** 📈 Good
322
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
323
+
324
+ ---
325
+
326
+ ### 🔵 Checkpoint — Step 12,793
327
+ **Date:** June 26, 2026 at 20:50 IST
328
+ **Checkpoint:** checkpoint-12793
329
+ **Step:** 12,793 / 40,000 (32.0% complete)
330
+ **Loss:** 0.2054
331
+ **Epoch:** 0.374
332
+ **Zone:** 🎯 Sweet Spot
333
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
334
+
335
+ ---
336
+
337
+ ### 🔵 Checkpoint — Step 13,000
338
+ **Date:** June 26, 2026 at 22:14 IST
339
+ **Checkpoint:** checkpoint-13000
340
+ **Step:** 13,000 / 40,000 (32.5% complete)
341
+ **Loss:** 0.2178
342
+ **Epoch:** 0.380
343
+ **Zone:** 🎯 Sweet Spot
344
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
345
+
346
+ ---
347
+
348
+ ### 🔵 Checkpoint — Step 14,000
349
+ **Date:** June 27, 2026 at 05:20 IST
350
+ **Checkpoint:** checkpoint-14000
351
+ **Step:** 14,000 / 40,000 (35.0% complete)
352
+ **Loss:** 0.2634
353
+ **Epoch:** 0.409
354
+ **Zone:** 📈 Good
355
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
356
+
357
+ ---
358
+
359
+ ### 🔵 Checkpoint — Step 14,769
360
+ **Date:** June 27, 2026 at 10:48 IST
361
+ **Checkpoint:** checkpoint-14769
362
+ **Step:** 14,769 / 40,000 (36.9% complete)
363
+ **Loss:** 0.1741
364
+ **Epoch:** 0.431
365
+ **Zone:** 🎯 Sweet Spot
366
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
367
+
368
+ ---
369
+
370
+ ### 🔵 Checkpoint — Step 14,907
371
+ **Date:** June 27, 2026 at 12:34 IST
372
+ **Checkpoint:** checkpoint-14907
373
+ **Step:** 14,907 / 40,000 (37.3% complete)
374
+ **Loss:** 0.2403
375
+ **Epoch:** 0.436
376
+ **Zone:** 🎯 Sweet Spot
377
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
378
+
379
+ ---
380
+
381
+ ### 🔵 Checkpoint — Step 15,000
382
+ **Date:** June 27, 2026 at 13:25 IST
383
+ **Checkpoint:** checkpoint-15000
384
+ **Step:** 15,000 / 40,000 (37.5% complete)
385
+ **Loss:** 0.2500
386
+ **Epoch:** 0.438
387
+ **Zone:** 📈 Good
388
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
389
+
390
+ ---
391
+
392
+ ### 🔵 Checkpoint — Step 15,176
393
+ **Date:** June 27, 2026 at 16:14 IST
394
+ **Checkpoint:** checkpoint-15176
395
+ **Step:** 15,176 / 40,000 (37.9% complete)
396
+ **Loss:** 0.1106
397
+ **Epoch:** 0.443
398
+ **Zone:** ⚠️ Overfit Risk
399
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
400
+
401
+ ---
402
+
403
+ ### 🔵 Checkpoint — Step 15,215
404
+ **Date:** June 27, 2026 at 16:31 IST
405
+ **Checkpoint:** checkpoint-15215
406
+ **Step:** 15,215 / 40,000 (38.0% complete)
407
+ **Loss:** 0.1262
408
+ **Epoch:** 0.445
409
+ **Zone:** 🎯 Sweet Spot
410
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
411
+
412
+ ---
413
+
414
+ ### 🔵 Checkpoint — Step 15,743
415
+ **Date:** June 27, 2026 at 20:14 IST
416
+ **Checkpoint:** checkpoint-15743
417
+ **Step:** 15,743 / 40,000 (39.4% complete)
418
+ **Loss:** 0.1310
419
+ **Epoch:** 0.460
420
+ **Zone:** 🎯 Sweet Spot
421
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
422
+
423
+ ---
424
+
425
+ ### 🔵 Checkpoint — Step 16,000
426
+ **Date:** June 27, 2026 at 22:07 IST
427
+ **Checkpoint:** checkpoint-16000
428
+ **Step:** 16,000 / 40,000 (40.0% complete)
429
+ **Loss:** 0.1250
430
+ **Epoch:** 0.468
431
+ **Zone:** 🎯 Sweet Spot
432
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
433
+
434
+ ---
435
+
436
+ ### 🔵 Checkpoint — Step 16,053
437
+ **Date:** June 27, 2026 at 23:06 IST
438
+ **Checkpoint:** checkpoint-16053
439
+ **Step:** 16,053 / 40,000 (40.1% complete)
440
+ **Loss:** 0.1144
441
+ **Epoch:** 0.469
442
+ **Zone:** ⚠️ Overfit Risk
443
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
444
+
445
+ ---
446
+
447
+ ### 🔵 Checkpoint — Step 16,148
448
+ **Date:** June 28, 2026 at 00:24 IST
449
+ **Checkpoint:** checkpoint-16148
450
+ **Step:** 16,148 / 40,000 (40.4% complete)
451
+ **Loss:** 0.1240
452
+ **Epoch:** 0.472
453
+ **Zone:** 🎯 Sweet Spot
454
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
455
+
456
+ ---
457
+
458
+ ### 🔵 Checkpoint — Step 17,000
459
+ **Date:** June 28, 2026 at 06:13 IST
460
+ **Checkpoint:** checkpoint-17000
461
+ **Step:** 17,000 / 40,000 (42.5% complete)
462
+ **Loss:** 0.1117
463
+ **Epoch:** 0.497
464
+ **Zone:** ⚠️ Overfit Risk
465
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
466
+
467
+ ---
468
+
469
+ ### 🔵 Checkpoint — Step 17,594
470
+ **Date:** June 28, 2026 at 10:16 IST
471
+ **Checkpoint:** checkpoint-17594
472
+ **Step:** 17,594 / 40,000 (44.0% complete)
473
+ **Loss:** 0.2489
474
+ **Epoch:** 0.514
475
+ **Zone:** 🎯 Sweet Spot
476
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
477
+
478
+ ---
479
+
480
+ ### 🔵 Checkpoint — Step 18,000
481
+ **Date:** June 28, 2026 at 18:25 IST
482
+ **Checkpoint:** checkpoint-18000
483
+ **Step:** 18,000 / 40,000 (45.0% complete)
484
+ **Loss:** 0.0850
485
+ **Epoch:** 0.526
486
+ **Zone:** ⚠️ Overfit Risk
487
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
488
+
489
+ ---
490
+
491
+ ### 🔵 Checkpoint — Step 18,594
492
+ **Date:** June 28, 2026 at 22:39 IST
493
+ **Checkpoint:** checkpoint-18594
494
+ **Step:** 18,594 / 40,000 (46.5% complete)
495
+ **Loss:** 0.0885
496
+ **Epoch:** 0.543
497
+ **Zone:** ⚠️ Overfit Risk
498
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
499
+
500
+ ---
501
+
502
+ ### 🔵 Checkpoint — Step 19,000
503
+ **Date:** June 29, 2026 at 02:10 IST
504
+ **Checkpoint:** checkpoint-19000
505
+ **Step:** 19,000 / 40,000 (47.5% complete)
506
+ **Loss:** 0.0535
507
+ **Epoch:** 0.555
508
+ **Zone:** ⚠️ Overfit Risk
509
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
510
+
511
+ ---
512
+
513
+ ### 🔵 Checkpoint — Step 20,000
514
+ **Date:** June 29, 2026 at 08:56 IST
515
+ **Checkpoint:** checkpoint-20000
516
+ **Step:** 20,000 / 40,000 (50.0% complete)
517
+ **Loss:** 0.1070
518
+ **Epoch:** 0.585
519
+ **Zone:** ⚠️ Overfit Risk
520
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
521
+
522
+ ---
523
+
524
+ ### 🔵 Checkpoint — Step 21,000
525
+ **Date:** June 29, 2026 at 15:45 IST
526
+ **Checkpoint:** checkpoint-21000
527
+ **Step:** 21,000 / 40,000 (52.5% complete)
528
+ **Loss:** 0.1521
529
+ **Epoch:** 0.614
530
+ **Zone:** 🎯 Sweet Spot
531
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
532
+
533
+ ---
534
+
535
+ ### 🔵 Checkpoint — Step 21,404
536
+ **Date:** June 29, 2026 at 18:52 IST
537
+ **Checkpoint:** checkpoint-21404
538
+ **Step:** 21,404 / 40,000 (53.5% complete)
539
+ **Loss:** 0.2434
540
+ **Epoch:** 0.625
541
+ **Zone:** 🎯 Sweet Spot
542
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
543
+
544
+ ---
545
+
546
+ ### 🔵 Checkpoint — Step 22,000
547
+ **Date:** June 30, 2026 at 00:08 IST
548
+ **Checkpoint:** checkpoint-22000
549
+ **Step:** 22,000 / 40,000 (55.0% complete)
550
+ **Loss:** 0.2471
551
+ **Epoch:** 0.643
552
+ **Zone:** 🎯 Sweet Spot
553
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
554
+
555
+ ---
556
+
557
+ ### 🔵 Checkpoint — Step 23,000
558
+ **Date:** June 30, 2026 at 07:12 IST
559
+ **Checkpoint:** checkpoint-23000
560
+ **Step:** 23,000 / 40,000 (57.5% complete)
561
+ **Loss:** 0.3085
562
+ **Epoch:** 0.672
563
+ **Zone:** 📈 Good
564
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
565
+
566
+ ---
567
+
568
+ ### 🔵 Checkpoint — Step 23,828
569
+ **Date:** June 30, 2026 at 12:51 IST
570
+ **Checkpoint:** checkpoint-23828
571
+ **Step:** 23,828 / 40,000 (59.6% complete)
572
+ **Loss:** 0.2647
573
+ **Epoch:** 0.696
574
+ **Zone:** 📈 Good
575
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
576
+
577
+ ---
578
+
579
+ ### 🔵 Checkpoint — Step 23,831
580
+ **Date:** June 30, 2026 at 14:50 IST
581
+ **Checkpoint:** checkpoint-23831
582
+ **Step:** 23,831 / 40,000 (59.6% complete)
583
+ **Loss:** 0.1715
584
+ **Epoch:** 0.697
585
+ **Zone:** 🎯 Sweet Spot
586
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
587
+
588
+ ---
589
+
590
+ ### 🔵 Checkpoint — Step 24,000
591
+ **Date:** June 30, 2026 at 16:27 IST
592
+ **Checkpoint:** checkpoint-24000
593
+ **Step:** 24,000 / 40,000 (60.0% complete)
594
+ **Loss:** 0.0595
595
+ **Epoch:** 0.701
596
+ **Zone:** ⚠️ Overfit Risk
597
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
598
+
599
+ ---
600
+
601
+ ### 🔵 Checkpoint — Step 25,000
602
+ **Date:** July 01, 2026 at 01:20 IST
603
+ **Checkpoint:** checkpoint-25000
604
+ **Step:** 25,000 / 40,000 (62.5% complete)
605
+ **Loss:** 0.0601
606
+ **Epoch:** 0.731
607
+ **Zone:** ⚠️ Overfit Risk
608
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
609
+
610
+ ---
611
+
612
+ ### 🔵 Checkpoint — Step 26,000
613
+ **Date:** July 01, 2026 at 08:42 IST
614
+ **Checkpoint:** checkpoint-26000
615
+ **Step:** 26,000 / 40,000 (65.0% complete)
616
+ **Loss:** 0.0775
617
+ **Epoch:** 0.760
618
+ **Zone:** ⚠️ Overfit Risk
619
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
620
+
621
+ ---
622
+
623
+ ### 🔵 Checkpoint — Step 27,000
624
+ **Date:** July 01, 2026 at 15:25 IST
625
+ **Checkpoint:** checkpoint-27000
626
+ **Step:** 27,000 / 40,000 (67.5% complete)
627
+ **Loss:** 0.1404
628
+ **Epoch:** 0.789
629
+ **Zone:** 🎯 Sweet Spot
630
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
631
+
632
+ ---
633
+
634
+ ### 🔵 Checkpoint — Step 27,337
635
+ **Date:** July 01, 2026 at 18:36 IST
636
+ **Checkpoint:** checkpoint-27337
637
+ **Step:** 27,337 / 40,000 (68.3% complete)
638
+ **Loss:** 0.1436
639
+ **Epoch:** 0.799
640
+ **Zone:** 🎯 Sweet Spot
641
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
642
+
643
+ ---
644
+
645
+ ### 🔵 Checkpoint — Step 28,000
646
+ **Date:** July 02, 2026 at 02:15 IST
647
+ **Checkpoint:** checkpoint-28000
648
+ **Step:** 28,000 / 40,000 (70.0% complete)
649
+ **Loss:** 0.2129
650
+ **Epoch:** 0.818
651
+ **Zone:** 🎯 Sweet Spot
652
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
653
+
654
+ ---
655
+
656
+ ### 🔵 Checkpoint — Step 29,000
657
+ **Date:** July 02, 2026 at 09:14 IST
658
+ **Checkpoint:** checkpoint-29000
659
+ **Step:** 29,000 / 40,000 (72.5% complete)
660
+ **Loss:** 0.1455
661
+ **Epoch:** 0.848
662
+ **Zone:** 🎯 Sweet Spot
663
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
664
+
665
+ ---
666
+
667
+ ### 🔵 Checkpoint — Step 30,000
668
+ **Date:** July 02, 2026 at 16:08 IST
669
+ **Checkpoint:** checkpoint-30000
670
+ **Step:** 30,000 / 40,000 (75.0% complete)
671
+ **Loss:** 0.3397
672
+ **Epoch:** 0.877
673
+ **Zone:** 📈 Good
674
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
675
+
676
+ ---
677
+
678
+ ### 🔵 Checkpoint — Step 30,784
679
+ **Date:** July 02, 2026 at 23:18 IST
680
+ **Checkpoint:** checkpoint-30784
681
+ **Step:** 30,784 / 40,000 (77.0% complete)
682
+ **Loss:** 0.3424
683
+ **Epoch:** 0.900
684
+ **Zone:** 📈 Good
685
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
686
+
687
+ ---
688
+
689
+ ### 🔵 Checkpoint — Step 31,000
690
+ **Date:** July 03, 2026 at 00:56 IST
691
+ **Checkpoint:** checkpoint-31000
692
+ **Step:** 31,000 / 40,000 (77.5% complete)
693
+ **Loss:** 0.0332
694
+ **Epoch:** 0.906
695
+ **Zone:** ⚠️ Overfit Risk
696
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
697
+
698
+ ---
699
+
700
+ ### 🔵 Checkpoint — Step 32,000
701
+ **Date:** July 03, 2026 at 07:45 IST
702
+ **Checkpoint:** checkpoint-32000
703
+ **Step:** 32,000 / 40,000 (80.0% complete)
704
+ **Loss:** 0.0608
705
+ **Epoch:** 0.935
706
+ **Zone:** ⚠️ Overfit Risk
707
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
708
+
709
+ ---
710
+
711
+ ### 🔵 Checkpoint — Step 32,001
712
+ **Date:** July 03, 2026 at 15:52 IST
713
+ **Checkpoint:** checkpoint-32001
714
+ **Step:** 32,001 / 40,000 (80.0% complete)
715
+ **Loss:** 0.0000
716
+ **Epoch:** 0.000
717
+ **Zone:** ⚠️ Overfit Risk
718
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
719
+
720
+ ---
721
+
722
+ ### 🔵 Checkpoint — Step 33,000
723
+ **Date:** July 04, 2026 at 00:31 IST
724
+ **Checkpoint:** checkpoint-33000
725
+ **Step:** 33,000 / 40,000 (82.5% complete)
726
+ **Loss:** 0.0135
727
+ **Epoch:** 0.965
728
+ **Zone:** ⚠️ Overfit Risk
729
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
730
+
731
+ ---
732
+
733
+ ### 🔵 Checkpoint — Step 34,000
734
+ **Date:** July 04, 2026 at 07:24 IST
735
+ **Checkpoint:** checkpoint-34000
736
+ **Step:** 34,000 / 40,000 (85.0% complete)
737
+ **Loss:** 0.0401
738
+ **Epoch:** 0.994
739
+ **Zone:** ⚠️ Overfit Risk
740
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
741
+
742
+ ---
743
+
744
+ ### 🔵 Checkpoint — Step 34,213
745
+ **Date:** July 04, 2026 at 08:52 IST
746
+ **Checkpoint:** checkpoint-34213
747
+ **Step:** 34,213 / 40,000 (85.5% complete)
748
+ **Loss:** 0.0397
749
+ **Epoch:** 1.000
750
+ **Zone:** ⚠️ Overfit Risk
751
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
752
+
753
+ ---
754
+
755
+ ### 🔵 Checkpoint — Step 35,000
756
+ **Date:** July 04, 2026 at 14:22 IST
757
+ **Checkpoint:** checkpoint-35000
758
+ **Step:** 35,000 / 40,000 (87.5% complete)
759
+ **Loss:** 0.1045
760
+ **Epoch:** 1.023
761
+ **Zone:** ⚠️ Overfit Risk
762
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
763
+
764
+ ---
765
+
766
+ ### 🔵 Checkpoint — Step 36,000
767
+ **Date:** July 04, 2026 at 21:15 IST
768
+ **Checkpoint:** checkpoint-36000
769
+ **Step:** 36,000 / 40,000 (90.0% complete)
770
+ **Loss:** 0.1610
771
+ **Epoch:** 1.052
772
+ **Zone:** 🎯 Sweet Spot
773
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
774
+
775
+ ---
776
+
777
+ ### 🔵 Checkpoint — Step 37,000
778
+ **Date:** July 05, 2026 at 03:59 IST
779
+ **Checkpoint:** checkpoint-37000
780
+ **Step:** 37,000 / 40,000 (92.5% complete)
781
+ **Loss:** 0.1367
782
+ **Epoch:** 1.081
783
+ **Zone:** 🎯 Sweet Spot
784
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
785
+
786
+ ---
787
+
788
+ ### 🔵 Checkpoint — Step 37,001
789
+ **Date:** July 05, 2026 at 08:37 IST
790
+ **Checkpoint:** checkpoint-37001
791
+ **Step:** 37,001 / 40,000 (92.5% complete)
792
+ **Loss:** 0.0000
793
+ **Epoch:** 0.000
794
+ **Zone:** ⚠️ Overfit Risk
795
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
796
+
797
+ ---
798
+
799
+ ### 🔵 Checkpoint — Step 37,002
800
+ **Date:** July 05, 2026 at 11:06 IST
801
+ **Checkpoint:** checkpoint-37002
802
+ **Step:** 37,002 / 40,000 (92.5% complete)
803
+ **Loss:** 0.0000
804
+ **Epoch:** 0.000
805
+ **Zone:** ⚠️ Overfit Risk
806
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
807
+
808
+ ---
809
+
810
+ ### 🔵 Checkpoint — Step 38,000
811
+ **Date:** July 05, 2026 at 20:26 IST
812
+ **Checkpoint:** checkpoint-38000
813
+ **Step:** 38,000 / 40,000 (95.0% complete)
814
+ **Loss:** 0.3587
815
+ **Epoch:** 1.111
816
+ **Zone:** 📈 Good
817
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
818
+
819
+ ---
820
+
821
+ ### 🔵 Checkpoint — Step 38,001
822
+ **Date:** July 05, 2026 at 23:47 IST
823
+ **Checkpoint:** checkpoint-38001
824
+ **Step:** 38,001 / 40,000 (95.0% complete)
825
+ **Loss:** 0.0000
826
+ **Epoch:** 0.000
827
+ **Zone:** ⚠️ Overfit Risk
828
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
829
+
830
+ ---
831
+
832
+ ### 🔵 Checkpoint — Step 38,194
833
+ **Date:** July 06, 2026 at 01:29 IST
834
+ **Checkpoint:** checkpoint-38194
835
+ **Step:** 38,194 / 40,000 (95.5% complete)
836
+ **Loss:** 0.3055
837
+ **Epoch:** 1.116
838
+ **Zone:** 📈 Good
839
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
840
+
841
+ ---
842
+
843
+ ### 🔵 Checkpoint — Step 38,195
844
+ **Date:** July 06, 2026 at 08:35 IST
845
+ **Checkpoint:** checkpoint-38195
846
+ **Step:** 38,195 / 40,000 (95.5% complete)
847
+ **Loss:** 0.0000
848
+ **Epoch:** 0.000
849
+ **Zone:** ⚠️ Overfit Risk
850
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
851
+
852
+ ---
853
+
854
+ ### 🔵 Checkpoint — Step 38,001
855
+ **Date:** July 09, 2026 at 07:43 IST
856
+ **Checkpoint:** checkpoint-38001
857
+ **Step:** 38,001 / 40,000 (95.0% complete)
858
+ **Loss:** 0.0000
859
+ **Epoch:** 0.000
860
+ **Zone:** ⚠️ Overfit Risk
861
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
862
+
863
+ ---
864
+
865
+ ### 🔵 Checkpoint — Step 39,000
866
+ **Date:** July 09, 2026 at 14:54 IST
867
+ **Checkpoint:** checkpoint-39000
868
+ **Step:** 39,000 / 40,000 (97.5% complete)
869
+ **Loss:** 0.3616
870
+ **Epoch:** 1.140
871
+ **Zone:** 📈 Good
872
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
873
+
874
+ ---
875
+
876
+ ### 🔵 Checkpoint — Step 39,931
877
+ **Date:** July 09, 2026 at 21:09 IST
878
+ **Checkpoint:** checkpoint-39931
879
+ **Step:** 39,931 / 40,000 (99.8% complete)
880
+ **Loss:** 0.3269
881
+ **Epoch:** 1.167
882
+ **Zone:** 📈 Good
883
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
884
+
885
+ ---
886
+
887
+ ### 🔵 Checkpoint — Step 39,932
888
+ **Date:** July 09, 2026 at 21:29 IST
889
+ **Checkpoint:** checkpoint-39932
890
+ **Step:** 39,932 / 40,000 (99.8% complete)
891
+ **Loss:** 0.0000
892
+ **Epoch:** 0.000
893
+ **Zone:** ⚠️ Overfit Risk
894
+ **Status:** Training ongoing — auto-uploaded via train_v12.py
checkpoint-39932/adapter_config.json ADDED
@@ -0,0 +1,48 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "alora_invocation_tokens": null,
3
+ "alpha_pattern": {},
4
+ "arrow_config": null,
5
+ "auto_mapping": null,
6
+ "base_model_name_or_path": "Qwen/Qwen2.5-Coder-7B-Instruct",
7
+ "bias": "none",
8
+ "corda_config": null,
9
+ "ensure_weight_tying": false,
10
+ "eva_config": null,
11
+ "exclude_modules": null,
12
+ "fan_in_fan_out": false,
13
+ "inference_mode": true,
14
+ "init_lora_weights": true,
15
+ "layer_replication": null,
16
+ "layers_pattern": null,
17
+ "layers_to_transform": null,
18
+ "loftq_config": {},
19
+ "lora_alpha": 128,
20
+ "lora_bias": false,
21
+ "lora_dropout": 0.05,
22
+ "lora_ga_config": null,
23
+ "megatron_config": null,
24
+ "megatron_core": "megatron.core",
25
+ "modules_to_save": null,
26
+ "peft_type": "LORA",
27
+ "peft_version": "0.19.1",
28
+ "qalora_group_size": 16,
29
+ "r": 64,
30
+ "rank_pattern": {},
31
+ "revision": null,
32
+ "target_modules": [
33
+ "v_proj",
34
+ "gate_proj",
35
+ "down_proj",
36
+ "q_proj",
37
+ "o_proj",
38
+ "k_proj",
39
+ "up_proj"
40
+ ],
41
+ "target_parameters": null,
42
+ "task_type": "CAUSAL_LM",
43
+ "trainable_token_indices": null,
44
+ "use_bdlora": null,
45
+ "use_dora": false,
46
+ "use_qalora": false,
47
+ "use_rslora": false
48
+ }
checkpoint-39932/adapter_model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:feeea81c9ab3cbc9048daae840c7f4528e1cf94aff1bebcf4f1677a587244584
3
+ size 645975704
checkpoint-39932/chat_template.jinja ADDED
@@ -0,0 +1,54 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {%- if tools %}
2
+ {{- '<|im_start|>system\n' }}
3
+ {%- if messages[0]['role'] == 'system' %}
4
+ {{- messages[0]['content'] }}
5
+ {%- else %}
6
+ {{- 'You are Qwen, created by Alibaba Cloud. You are a helpful assistant.' }}
7
+ {%- endif %}
8
+ {{- "\n\n# Tools\n\nYou may call one or more functions to assist with the user query.\n\nYou are provided with function signatures within <tools></tools> XML tags:\n<tools>" }}
9
+ {%- for tool in tools %}
10
+ {{- "\n" }}
11
+ {{- tool | tojson }}
12
+ {%- endfor %}
13
+ {{- "\n</tools>\n\nFor each function call, return a json object with function name and arguments within <tool_call></tool_call> XML tags:\n<tool_call>\n{\"name\": <function-name>, \"arguments\": <args-json-object>}\n</tool_call><|im_end|>\n" }}
14
+ {%- else %}
15
+ {%- if messages[0]['role'] == 'system' %}
16
+ {{- '<|im_start|>system\n' + messages[0]['content'] + '<|im_end|>\n' }}
17
+ {%- else %}
18
+ {{- '<|im_start|>system\nYou are Qwen, created by Alibaba Cloud. You are a helpful assistant.<|im_end|>\n' }}
19
+ {%- endif %}
20
+ {%- endif %}
21
+ {%- for message in messages %}
22
+ {%- if (message.role == "user") or (message.role == "system" and not loop.first) or (message.role == "assistant" and not message.tool_calls) %}
23
+ {{- '<|im_start|>' + message.role + '\n' + message.content + '<|im_end|>' + '\n' }}
24
+ {%- elif message.role == "assistant" %}
25
+ {{- '<|im_start|>' + message.role }}
26
+ {%- if message.content %}
27
+ {{- '\n' + message.content }}
28
+ {%- endif %}
29
+ {%- for tool_call in message.tool_calls %}
30
+ {%- if tool_call.function is defined %}
31
+ {%- set tool_call = tool_call.function %}
32
+ {%- endif %}
33
+ {{- '\n<tool_call>\n{"name": "' }}
34
+ {{- tool_call.name }}
35
+ {{- '", "arguments": ' }}
36
+ {{- tool_call.arguments | tojson }}
37
+ {{- '}\n</tool_call>' }}
38
+ {%- endfor %}
39
+ {{- '<|im_end|>\n' }}
40
+ {%- elif message.role == "tool" %}
41
+ {%- if (loop.index0 == 0) or (messages[loop.index0 - 1].role != "tool") %}
42
+ {{- '<|im_start|>user' }}
43
+ {%- endif %}
44
+ {{- '\n<tool_response>\n' }}
45
+ {{- message.content }}
46
+ {{- '\n</tool_response>' }}
47
+ {%- if loop.last or (messages[loop.index0 + 1].role != "tool") %}
48
+ {{- '<|im_end|>\n' }}
49
+ {%- endif %}
50
+ {%- endif %}
51
+ {%- endfor %}
52
+ {%- if add_generation_prompt %}
53
+ {{- '<|im_start|>assistant\n' }}
54
+ {%- endif %}
checkpoint-39932/optimizer.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:14137572ab71107d932609bcd39859fbdb94809c11ea4411b7fdd1e7bfe9583d
3
+ size 329492947
checkpoint-39932/rng_state.pth ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:0486ee8011797d49fe5a8e510e425c4b604c4ec1d92295b173f33ddf0333fcce
3
+ size 14645
checkpoint-39932/scheduler.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:1ae79bf08157bdc0f10ba1b8eb5fe078e7e082f5148dcb8739a2a774148187db
3
+ size 1465
checkpoint-39932/tokenizer.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3fd169731d2cbde95e10bf356d66d5997fd885dd8dbb6fb4684da3f23b2585d8
3
+ size 11421892
checkpoint-39932/tokenizer_config.json ADDED
@@ -0,0 +1,30 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "add_prefix_space": false,
3
+ "backend": "tokenizers",
4
+ "bos_token": null,
5
+ "clean_up_tokenization_spaces": false,
6
+ "eos_token": "<|im_end|>",
7
+ "errors": "replace",
8
+ "extra_special_tokens": [
9
+ "<|im_start|>",
10
+ "<|im_end|>",
11
+ "<|object_ref_start|>",
12
+ "<|object_ref_end|>",
13
+ "<|box_start|>",
14
+ "<|box_end|>",
15
+ "<|quad_start|>",
16
+ "<|quad_end|>",
17
+ "<|vision_start|>",
18
+ "<|vision_end|>",
19
+ "<|vision_pad|>",
20
+ "<|image_pad|>",
21
+ "<|video_pad|>"
22
+ ],
23
+ "is_local": false,
24
+ "local_files_only": false,
25
+ "model_max_length": 32768,
26
+ "pad_token": "<|im_end|>",
27
+ "split_special_tokens": false,
28
+ "tokenizer_class": "Qwen2Tokenizer",
29
+ "unk_token": null
30
+ }
checkpoint-39932/trainer_state.json ADDED
The diff for this file is too large to render. See raw diff
 
checkpoint-39932/training_args.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e6ab51bd599651344f26a67a1d940a2b6432da90051bdf388dcef2423ea1342d
3
+ size 5329