Monike123 commited on
Commit
edc0d97
·
verified ·
1 Parent(s): 9f4923f

Add v8 LoRA adapter + evaluation plots

Browse files
adapter/adapter_config.json CHANGED
@@ -10,18 +10,20 @@
10
  "layers_pattern": null,
11
  "layers_to_transform": null,
12
  "loftq_config": {},
13
- "lora_alpha": 16,
14
  "lora_dropout": 0.05,
15
  "megatron_config": null,
16
  "megatron_core": "megatron.core",
17
  "modules_to_save": null,
18
  "peft_type": "LORA",
19
- "r": 8,
20
  "rank_pattern": {},
21
  "revision": null,
22
  "target_modules": [
23
- "v_proj",
24
- "q_proj"
 
 
25
  ],
26
  "task_type": "CAUSAL_LM",
27
  "use_dora": false,
 
10
  "layers_pattern": null,
11
  "layers_to_transform": null,
12
  "loftq_config": {},
13
+ "lora_alpha": 32,
14
  "lora_dropout": 0.05,
15
  "megatron_config": null,
16
  "megatron_core": "megatron.core",
17
  "modules_to_save": null,
18
  "peft_type": "LORA",
19
+ "r": 16,
20
  "rank_pattern": {},
21
  "revision": null,
22
  "target_modules": [
23
+ "q_proj",
24
+ "k_proj",
25
+ "o_proj",
26
+ "v_proj"
27
  ],
28
  "task_type": "CAUSAL_LM",
29
  "use_dora": false,
adapter/adapter_model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:adc0418e4e2f3e610f8389bdc2f89c65039ecc60301144df3809f365f3915006
3
- size 16794200
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:6dbe3323b64f9793bd42f6b4ea712a45a75cc6c1123fefd854d9a9f27f3ffba6
3
+ size 67143296
adapter/eval_plots/eval_log.json CHANGED
@@ -1,50 +1,42 @@
1
  [
2
  {
3
  "step": 100,
4
- "eval_loss": 1.8240644931793213
5
  },
6
  {
7
  "step": 200,
8
- "eval_loss": 1.0799707174301147
9
  },
10
  {
11
  "step": 300,
12
- "eval_loss": 0.9546574950218201
13
  },
14
  {
15
  "step": 400,
16
- "eval_loss": 0.8702907562255859
17
  },
18
  {
19
  "step": 500,
20
- "eval_loss": 0.787815272808075
21
  },
22
  {
23
  "step": 600,
24
- "eval_loss": 0.6270484328269958
25
  },
26
  {
27
  "step": 700,
28
- "eval_loss": 0.5892859101295471
29
  },
30
  {
31
  "step": 800,
32
- "eval_loss": 0.5660054087638855
33
  },
34
  {
35
  "step": 900,
36
- "eval_loss": 0.5496686697006226
37
  },
38
  {
39
  "step": 1000,
40
- "eval_loss": 0.5432103872299194
41
- },
42
- {
43
- "step": 1100,
44
- "eval_loss": 0.5394924879074097
45
- },
46
- {
47
- "step": 1200,
48
- "eval_loss": 0.5386649966239929
49
  }
50
  ]
 
1
  [
2
  {
3
  "step": 100,
4
+ "eval_loss": 0.48696422576904297
5
  },
6
  {
7
  "step": 200,
8
+ "eval_loss": 0.34586554765701294
9
  },
10
  {
11
  "step": 300,
12
+ "eval_loss": 0.28842663764953613
13
  },
14
  {
15
  "step": 400,
16
+ "eval_loss": 0.2540067136287689
17
  },
18
  {
19
  "step": 500,
20
+ "eval_loss": 0.2295776903629303
21
  },
22
  {
23
  "step": 600,
24
+ "eval_loss": 0.21396693587303162
25
  },
26
  {
27
  "step": 700,
28
+ "eval_loss": 0.19977937638759613
29
  },
30
  {
31
  "step": 800,
32
+ "eval_loss": 0.19195251166820526
33
  },
34
  {
35
  "step": 900,
36
+ "eval_loss": 0.18890142440795898
37
  },
38
  {
39
  "step": 1000,
40
+ "eval_loss": 0.18816642463207245
 
 
 
 
 
 
 
 
41
  }
42
  ]
adapter/eval_plots/eval_results.json CHANGED
@@ -1,56 +1,56 @@
1
  {
2
  "summary": {
3
- "keyword_accuracy": 0.7058823529411765,
4
  "format_accuracy": 0.0,
5
  "precision": 1.0,
6
- "recall": 0.7058823529411765,
7
- "f1": 0.8275862068965517,
8
- "avg_rouge1": 0.25364705882352945,
9
- "avg_rouge2": 0.06123529411764707,
10
- "avg_rougeL": 0.25364705882352945,
11
- "avg_response_time": 16.716294117647056
12
  },
13
  "per_category": {
14
  "DS Logic": {
15
  "accuracy": 1.0,
16
  "format": 0.0,
17
- "rougeL": 0.0,
18
- "avg_time": 16.393,
19
  "n": 2
20
  },
21
  "LangChain": {
22
- "accuracy": 0.0,
23
  "format": 0.0,
24
- "rougeL": 0.0,
25
- "avg_time": 16.93,
26
  "n": 4
27
  },
28
  "ML": {
29
  "accuracy": 1.0,
30
  "format": 0.0,
31
- "rougeL": 0.43,
32
- "avg_time": 16.838,
33
  "n": 3
34
  },
35
  "Pandas": {
36
  "accuracy": 1.0,
37
  "format": 0.0,
38
- "rougeL": 0.347,
39
- "avg_time": 17.03,
40
  "n": 4
41
  },
42
  "R": {
43
  "accuracy": 0.5,
44
  "format": 0.0,
45
- "rougeL": 0.486,
46
- "avg_time": 15.999,
47
  "n": 2
48
  },
49
  "Viz": {
50
  "accuracy": 1.0,
51
  "format": 0.0,
52
- "rougeL": 0.333,
53
- "avg_time": 16.522,
54
  "n": 2
55
  }
56
  },
@@ -59,74 +59,74 @@
59
  "category": "LangChain",
60
  "prompt": "What function limits the number of messages passed to a model by counting tokens in Langchain? in Python ?",
61
  "keyword": "trim_messages",
62
- "library": "import nltk",
63
- "code": "nltk.LangChain(5) \n.add_rule('[A-Za-z]+', '[A-Za-z]+') \n.add_rule('[0-9]+', '[0-9]+') \n.add_rule('[A-Za-z0-9]+', '[A-Za-z0-9]+') \n.add_rule('[A-Za-z0-9\\.]+', '[A-Za-z0-9\\.]+') \n.add_rule('[A-Za-z",
64
  "math": "",
65
  "rouge1": 0.0,
66
  "rouge2": 0.0,
67
  "rougeL": 0.0,
68
  "keyword_match": 0,
69
- "response_time": 16.873,
70
- "output_tokens": 200,
71
  "format_correct": 0
72
  },
73
  {
74
  "category": "LangChain",
75
  "prompt": "What argument enables jq schema parsing for content_key in JSONLoader in Langchain? in Python ?",
76
  "keyword": "is_content_key_jq_parsable",
77
- "library": "import pandas as pd",
78
- "code": "df = pd.read_json('file.json', orient='records')",
79
  "math": "",
80
- "rouge1": 0.0,
81
- "rouge2": 0.0,
82
- "rougeL": 0.0,
83
  "keyword_match": 0,
84
- "response_time": 17.915,
85
- "output_tokens": 200,
86
  "format_correct": 0
87
  },
88
  {
89
  "category": "LangChain",
90
  "prompt": "What callback handler tracks token usage in Langchain? in Python ?",
91
  "keyword": "UsageMetadataCallbackHandler",
92
- "library": "TensorFlow",
93
- "code": "tf.keras.callbacks.Callback()",
94
  "math": "",
95
  "rouge1": 0.0,
96
  "rouge2": 0.0,
97
  "rougeL": 0.0,
98
  "keyword_match": 0,
99
- "response_time": 16.22,
100
- "output_tokens": 200,
101
  "format_correct": 0
102
  },
103
  {
104
  "category": "LangChain",
105
  "prompt": "What taxonomy is used on GitHub Issues for sorting and discovery in Langchain? in Python ?",
106
  "keyword": "Labels",
107
- "library": "import pandas as pd",
108
- "code": "df.sort_values('col', ascending=True).head()",
109
  "math": "",
110
- "rouge1": 0.0,
111
  "rouge2": 0.0,
112
- "rougeL": 0.0,
113
- "keyword_match": 0,
114
- "response_time": 16.711,
115
- "output_tokens": 200,
116
  "format_correct": 0
117
  },
118
  {
119
  "category": "Pandas",
120
  "prompt": "How to drop missing values in a pandas DataFrame? in Python ?",
121
  "keyword": "dropna",
122
- "library": "pd",
123
- "code": "df.dropna(inplace=True) \n.",
124
  "math": "",
125
- "rouge1": 0.4,
126
  "rouge2": 0.0,
127
- "rougeL": 0.4,
128
  "keyword_match": 1,
129
- "response_time": 18.061,
130
  "output_tokens": 200,
131
  "format_correct": 0
132
  },
@@ -134,44 +134,44 @@
134
  "category": "Pandas",
135
  "prompt": "How to read a CSV file using pandas? in Python ?",
136
  "keyword": "read_csv",
137
- "library": "import pandas as pd",
138
- "code": "df = pd.read_csv('file.csv') \n.",
139
  "math": "",
140
- "rouge1": 0.5,
141
- "rouge2": 0.333,
142
- "rougeL": 0.5,
143
  "keyword_match": 1,
144
- "response_time": 16.448,
145
- "output_tokens": 200,
146
  "format_correct": 0
147
  },
148
  {
149
  "category": "Pandas",
150
  "prompt": "How to rename a column in pandas? in Python ?",
151
  "keyword": "rename",
152
- "library": "import pandas as pd",
153
- "code": "df.rename(columns={'old_col': 'new_col'}, inplace=True) \n.",
154
  "math": "",
155
- "rouge1": 0.2,
156
  "rouge2": 0.0,
157
- "rougeL": 0.2,
158
  "keyword_match": 1,
159
- "response_time": 17.085,
160
- "output_tokens": 200,
161
  "format_correct": 0
162
  },
163
  {
164
  "category": "Pandas",
165
  "prompt": "How to group rows and compute aggregate in pandas? in Python ?",
166
  "keyword": "groupby",
167
- "library": "import pandas as pd",
168
- "code": "df.groupby('category').agg({'value': 'sum'}) \n.",
169
  "math": "",
170
- "rouge1": 0.286,
171
  "rouge2": 0.0,
172
- "rougeL": 0.286,
173
  "keyword_match": 1,
174
- "response_time": 16.524,
175
  "output_tokens": 200,
176
  "format_correct": 0
177
  },
@@ -179,14 +179,14 @@
179
  "category": "ML",
180
  "prompt": "How to train a decision tree classifier in sklearn? in Python ?",
181
  "keyword": "DecisionTreeClassifier",
182
- "library": "from sklearn.tree import DecisionTreeClassifier",
183
- "code": "clf = DecisionTreeClassifier()",
184
  "math": "",
185
- "rouge1": 0.667,
186
  "rouge2": 0.0,
187
- "rougeL": 0.667,
188
  "keyword_match": 1,
189
- "response_time": 16.391,
190
  "output_tokens": 200,
191
  "format_correct": 0
192
  },
@@ -194,14 +194,14 @@
194
  "category": "ML",
195
  "prompt": "How to split dataset into train and test in sklearn? in Python ?",
196
  "keyword": "train_test_split",
197
- "library": "from sklearn.model_selection import train_test_split",
198
- "code": "X_train, X_test = train_test_split(df, test_size=0.2)",
199
  "math": "",
200
- "rouge1": 0.4,
201
- "rouge2": 0.308,
202
- "rougeL": 0.4,
203
  "keyword_match": 1,
204
- "response_time": 17.126,
205
  "output_tokens": 200,
206
  "format_correct": 0
207
  },
@@ -209,45 +209,45 @@
209
  "category": "ML",
210
  "prompt": "How to normalize features using StandardScaler in sklearn? in Python ?",
211
  "keyword": "StandardScaler",
212
- "library": "from sklearn.preprocessing import StandardScaler",
213
- "code": "scaler = StandardScaler(); X_scaled = scaler.fit_transform(X)",
214
  "math": "",
215
- "rouge1": 0.222,
216
  "rouge2": 0.0,
217
- "rougeL": 0.222,
218
  "keyword_match": 1,
219
- "response_time": 16.996,
220
- "output_tokens": 200,
221
  "format_correct": 0
222
  },
223
  {
224
  "category": "Viz",
225
  "prompt": "How to plot a heatmap using seaborn? in Python ?",
226
  "keyword": "heatmap",
227
- "library": "import seaborn as sns",
228
- "code": "sns.heatmap(df, annot=True)",
229
  "math": "",
230
- "rouge1": 0.333,
231
  "rouge2": 0.0,
232
- "rougeL": 0.333,
233
  "keyword_match": 1,
234
- "response_time": 16.279,
235
- "output_tokens": 200,
236
  "format_correct": 0
237
  },
238
  {
239
  "category": "Viz",
240
  "prompt": "How to create a histogram using matplotlib? in Python ?",
241
  "keyword": "hist",
242
- "library": "import matplotlib.pyplot as plt",
243
- "code": "plt.hist(data, bins=5)",
244
  "math": "",
245
- "rouge1": 0.333,
246
  "rouge2": 0.0,
247
- "rougeL": 0.333,
248
  "keyword_match": 1,
249
- "response_time": 16.764,
250
- "output_tokens": 200,
251
  "format_correct": 0
252
  },
253
  {
@@ -255,59 +255,59 @@
255
  "prompt": "How to get the maximum value of a vector in R ?",
256
  "keyword": "max(",
257
  "library": "",
258
- "code": "max_value <- max(vector)",
259
  "math": "",
260
- "rouge1": 0.4,
261
  "rouge2": 0.0,
262
- "rougeL": 0.4,
263
  "keyword_match": 1,
264
- "response_time": 15.953,
265
- "output_tokens": 200,
266
  "format_correct": 0
267
  },
268
  {
269
  "category": "R",
270
  "prompt": "How to read a CSV file in R ?",
271
  "keyword": "read.csv",
272
- "library": "readr",
273
- "code": "df <- read_csv(\"file.csv\")",
274
  "math": "",
275
- "rouge1": 0.571,
276
- "rouge2": 0.4,
277
- "rougeL": 0.571,
278
  "keyword_match": 0,
279
- "response_time": 16.045,
280
- "output_tokens": 200,
281
  "format_correct": 0
282
  },
283
  {
284
  "category": "DS Logic",
285
  "prompt": "What does overfitting mean in machine learning? in Python ?",
286
  "keyword": "overfit",
287
- "library": "sklearn.linear_model",
288
- "code": "X = df[col_num].values; y = df['target'].values; lr = LogisticRegression(penalty='l2', C=10); lr.fit(X, y)",
289
  "math": "",
290
- "rouge1": 0.0,
291
  "rouge2": 0.0,
292
- "rougeL": 0.0,
293
  "keyword_match": 1,
294
- "response_time": 16.685,
295
- "output_tokens": 200,
296
  "format_correct": 0
297
  },
298
  {
299
  "category": "DS Logic",
300
  "prompt": "What is gradient descent in machine learning? in Python ?",
301
  "keyword": "gradient",
302
- "library": "from sklearn.linear_model import LinearRegression",
303
- "code": "reg = LinearRegression(); reg.fit(X, y)",
304
  "math": "",
305
- "rouge1": 0.0,
306
  "rouge2": 0.0,
307
- "rougeL": 0.0,
308
  "keyword_match": 1,
309
- "response_time": 16.101,
310
- "output_tokens": 200,
311
  "format_correct": 0
312
  }
313
  ]
 
1
  {
2
  "summary": {
3
+ "keyword_accuracy": 0.7647058823529411,
4
  "format_accuracy": 0.0,
5
  "precision": 1.0,
6
+ "recall": 0.7647058823529411,
7
+ "f1": 0.8666666666666667,
8
+ "avg_rouge1": 0.03211764705882353,
9
+ "avg_rouge2": 0.006058823529411765,
10
+ "avg_rougeL": 0.030941176470588236,
11
+ "avg_response_time": 16.512235294117644
12
  },
13
  "per_category": {
14
  "DS Logic": {
15
  "accuracy": 1.0,
16
  "format": 0.0,
17
+ "rougeL": 0.022,
18
+ "avg_time": 15.978,
19
  "n": 2
20
  },
21
  "LangChain": {
22
+ "accuracy": 0.25,
23
  "format": 0.0,
24
+ "rougeL": 0.022,
25
+ "avg_time": 17.225,
26
  "n": 4
27
  },
28
  "ML": {
29
  "accuracy": 1.0,
30
  "format": 0.0,
31
+ "rougeL": 0.031,
32
+ "avg_time": 22.483,
33
  "n": 3
34
  },
35
  "Pandas": {
36
  "accuracy": 1.0,
37
  "format": 0.0,
38
+ "rougeL": 0.031,
39
+ "avg_time": 17.45,
40
  "n": 4
41
  },
42
  "R": {
43
  "accuracy": 0.5,
44
  "format": 0.0,
45
+ "rougeL": 0.039,
46
+ "avg_time": 12.786,
47
  "n": 2
48
  },
49
  "Viz": {
50
  "accuracy": 1.0,
51
  "format": 0.0,
52
+ "rougeL": 0.05,
53
+ "avg_time": 8.516,
54
  "n": 2
55
  }
56
  },
 
59
  "category": "LangChain",
60
  "prompt": "What function limits the number of messages passed to a model by counting tokens in Langchain? in Python ?",
61
  "keyword": "trim_messages",
62
+ "library": "",
63
+ "code": "",
64
  "math": "",
65
  "rouge1": 0.0,
66
  "rouge2": 0.0,
67
  "rougeL": 0.0,
68
  "keyword_match": 0,
69
+ "response_time": 20.159,
70
+ "output_tokens": 190,
71
  "format_correct": 0
72
  },
73
  {
74
  "category": "LangChain",
75
  "prompt": "What argument enables jq schema parsing for content_key in JSONLoader in Langchain? in Python ?",
76
  "keyword": "is_content_key_jq_parsable",
77
+ "library": "",
78
+ "code": "",
79
  "math": "",
80
+ "rouge1": 0.081,
81
+ "rouge2": 0.021,
82
+ "rougeL": 0.061,
83
  "keyword_match": 0,
84
+ "response_time": 17.154,
85
+ "output_tokens": 137,
86
  "format_correct": 0
87
  },
88
  {
89
  "category": "LangChain",
90
  "prompt": "What callback handler tracks token usage in Langchain? in Python ?",
91
  "keyword": "UsageMetadataCallbackHandler",
92
+ "library": "",
93
+ "code": "",
94
  "math": "",
95
  "rouge1": 0.0,
96
  "rouge2": 0.0,
97
  "rougeL": 0.0,
98
  "keyword_match": 0,
99
+ "response_time": 19.01,
100
+ "output_tokens": 183,
101
  "format_correct": 0
102
  },
103
  {
104
  "category": "LangChain",
105
  "prompt": "What taxonomy is used on GitHub Issues for sorting and discovery in Langchain? in Python ?",
106
  "keyword": "Labels",
107
+ "library": "",
108
+ "code": "",
109
  "math": "",
110
+ "rouge1": 0.028,
111
  "rouge2": 0.0,
112
+ "rougeL": 0.028,
113
+ "keyword_match": 1,
114
+ "response_time": 12.577,
115
+ "output_tokens": 123,
116
  "format_correct": 0
117
  },
118
  {
119
  "category": "Pandas",
120
  "prompt": "How to drop missing values in a pandas DataFrame? in Python ?",
121
  "keyword": "dropna",
122
+ "library": "",
123
+ "code": "",
124
  "math": "",
125
+ "rouge1": 0.021,
126
  "rouge2": 0.0,
127
+ "rougeL": 0.021,
128
  "keyword_match": 1,
129
+ "response_time": 20.368,
130
  "output_tokens": 200,
131
  "format_correct": 0
132
  },
 
134
  "category": "Pandas",
135
  "prompt": "How to read a CSV file using pandas? in Python ?",
136
  "keyword": "read_csv",
137
+ "library": "",
138
+ "code": "",
139
  "math": "",
140
+ "rouge1": 0.061,
141
+ "rouge2": 0.031,
142
+ "rougeL": 0.061,
143
  "keyword_match": 1,
144
+ "response_time": 10.138,
145
+ "output_tokens": 98,
146
  "format_correct": 0
147
  },
148
  {
149
  "category": "Pandas",
150
  "prompt": "How to rename a column in pandas? in Python ?",
151
  "keyword": "rename",
152
+ "library": "",
153
+ "code": "",
154
  "math": "",
155
+ "rouge1": 0.023,
156
  "rouge2": 0.0,
157
+ "rougeL": 0.023,
158
  "keyword_match": 1,
159
+ "response_time": 19.195,
160
+ "output_tokens": 182,
161
  "format_correct": 0
162
  },
163
  {
164
  "category": "Pandas",
165
  "prompt": "How to group rows and compute aggregate in pandas? in Python ?",
166
  "keyword": "groupby",
167
+ "library": "",
168
+ "code": "",
169
  "math": "",
170
+ "rouge1": 0.019,
171
  "rouge2": 0.0,
172
+ "rougeL": 0.019,
173
  "keyword_match": 1,
174
+ "response_time": 20.097,
175
  "output_tokens": 200,
176
  "format_correct": 0
177
  },
 
179
  "category": "ML",
180
  "prompt": "How to train a decision tree classifier in sklearn? in Python ?",
181
  "keyword": "DecisionTreeClassifier",
182
+ "library": "",
183
+ "code": "",
184
  "math": "",
185
+ "rouge1": 0.019,
186
  "rouge2": 0.0,
187
+ "rougeL": 0.019,
188
  "keyword_match": 1,
189
+ "response_time": 20.672,
190
  "output_tokens": 200,
191
  "format_correct": 0
192
  },
 
194
  "category": "ML",
195
  "prompt": "How to split dataset into train and test in sklearn? in Python ?",
196
  "keyword": "train_test_split",
197
+ "library": "",
198
+ "code": "",
199
  "math": "",
200
+ "rouge1": 0.048,
201
+ "rouge2": 0.033,
202
+ "rougeL": 0.048,
203
  "keyword_match": 1,
204
+ "response_time": 20.794,
205
  "output_tokens": 200,
206
  "format_correct": 0
207
  },
 
209
  "category": "ML",
210
  "prompt": "How to normalize features using StandardScaler in sklearn? in Python ?",
211
  "keyword": "StandardScaler",
212
+ "library": "",
213
+ "code": "",
214
  "math": "",
215
+ "rouge1": 0.025,
216
  "rouge2": 0.0,
217
+ "rougeL": 0.025,
218
  "keyword_match": 1,
219
+ "response_time": 25.984,
220
+ "output_tokens": 136,
221
  "format_correct": 0
222
  },
223
  {
224
  "category": "Viz",
225
  "prompt": "How to plot a heatmap using seaborn? in Python ?",
226
  "keyword": "heatmap",
227
+ "library": "",
228
+ "code": "",
229
  "math": "",
230
+ "rouge1": 0.043,
231
  "rouge2": 0.0,
232
+ "rougeL": 0.043,
233
  "keyword_match": 1,
234
+ "response_time": 9.108,
235
+ "output_tokens": 87,
236
  "format_correct": 0
237
  },
238
  {
239
  "category": "Viz",
240
  "prompt": "How to create a histogram using matplotlib? in Python ?",
241
  "keyword": "hist",
242
+ "library": "",
243
+ "code": "",
244
  "math": "",
245
+ "rouge1": 0.057,
246
  "rouge2": 0.0,
247
+ "rougeL": 0.057,
248
  "keyword_match": 1,
249
+ "response_time": 7.924,
250
+ "output_tokens": 77,
251
  "format_correct": 0
252
  },
253
  {
 
255
  "prompt": "How to get the maximum value of a vector in R ?",
256
  "keyword": "max(",
257
  "library": "",
258
+ "code": "",
259
  "math": "",
260
+ "rouge1": 0.043,
261
  "rouge2": 0.0,
262
+ "rougeL": 0.043,
263
  "keyword_match": 1,
264
+ "response_time": 8.151,
265
+ "output_tokens": 75,
266
  "format_correct": 0
267
  },
268
  {
269
  "category": "R",
270
  "prompt": "How to read a CSV file in R ?",
271
  "keyword": "read.csv",
272
+ "library": "",
273
+ "code": "",
274
  "math": "",
275
+ "rouge1": 0.035,
276
+ "rouge2": 0.018,
277
+ "rougeL": 0.035,
278
  "keyword_match": 0,
279
+ "response_time": 17.421,
280
+ "output_tokens": 172,
281
  "format_correct": 0
282
  },
283
  {
284
  "category": "DS Logic",
285
  "prompt": "What does overfitting mean in machine learning? in Python ?",
286
  "keyword": "overfit",
287
+ "library": "",
288
+ "code": "",
289
  "math": "",
290
+ "rouge1": 0.026,
291
  "rouge2": 0.0,
292
+ "rougeL": 0.026,
293
  "keyword_match": 1,
294
+ "response_time": 11.186,
295
+ "output_tokens": 106,
296
  "format_correct": 0
297
  },
298
  {
299
  "category": "DS Logic",
300
  "prompt": "What is gradient descent in machine learning? in Python ?",
301
  "keyword": "gradient",
302
+ "library": "",
303
+ "code": "",
304
  "math": "",
305
+ "rouge1": 0.017,
306
  "rouge2": 0.0,
307
+ "rougeL": 0.017,
308
  "keyword_match": 1,
309
+ "response_time": 20.77,
310
+ "output_tokens": 196,
311
  "format_correct": 0
312
  }
313
  ]
adapter/eval_plots/loss_log.json CHANGED
@@ -1,482 +1,402 @@
1
  [
2
  {
3
  "step": 10,
4
- "loss": 3.7145
5
  },
6
  {
7
  "step": 20,
8
- "loss": 3.8108
9
  },
10
  {
11
  "step": 30,
12
- "loss": 3.8272
13
  },
14
  {
15
  "step": 40,
16
- "loss": 3.6441
17
  },
18
  {
19
  "step": 50,
20
- "loss": 3.6304
21
  },
22
  {
23
  "step": 60,
24
- "loss": 3.4205
25
  },
26
  {
27
  "step": 70,
28
- "loss": 3.0848
29
  },
30
  {
31
  "step": 80,
32
- "loss": 2.7674
33
  },
34
  {
35
  "step": 90,
36
- "loss": 2.6102
37
  },
38
  {
39
  "step": 100,
40
- "loss": 2.1779
41
  },
42
  {
43
  "step": 110,
44
- "loss": 1.6865
45
  },
46
  {
47
  "step": 120,
48
- "loss": 1.4528
49
  },
50
  {
51
  "step": 130,
52
- "loss": 1.3545
53
  },
54
  {
55
  "step": 140,
56
- "loss": 1.2961
57
  },
58
  {
59
  "step": 150,
60
- "loss": 1.2643
61
  },
62
  {
63
  "step": 160,
64
- "loss": 1.1677
65
  },
66
  {
67
  "step": 170,
68
- "loss": 1.1044
69
  },
70
  {
71
  "step": 180,
72
- "loss": 1.1668
73
  },
74
  {
75
  "step": 190,
76
- "loss": 1.098
77
  },
78
  {
79
  "step": 200,
80
- "loss": 1.0887
81
  },
82
  {
83
  "step": 210,
84
- "loss": 1.0874
85
  },
86
  {
87
  "step": 220,
88
- "loss": 1.1033
89
  },
90
  {
91
  "step": 230,
92
- "loss": 1.0045
93
  },
94
  {
95
  "step": 240,
96
- "loss": 1.0166
97
  },
98
  {
99
  "step": 250,
100
- "loss": 1.0397
101
  },
102
  {
103
  "step": 260,
104
- "loss": 1.02
105
  },
106
  {
107
  "step": 270,
108
- "loss": 0.9788
109
  },
110
  {
111
  "step": 280,
112
- "loss": 1.0221
113
  },
114
  {
115
  "step": 290,
116
- "loss": 0.9507
117
  },
118
  {
119
  "step": 300,
120
- "loss": 0.9196
121
  },
122
  {
123
  "step": 310,
124
- "loss": 0.9043
125
  },
126
  {
127
  "step": 320,
128
- "loss": 0.9055
129
  },
130
  {
131
  "step": 330,
132
- "loss": 0.9389
133
  },
134
  {
135
  "step": 340,
136
- "loss": 0.9211
137
  },
138
  {
139
  "step": 350,
140
- "loss": 0.9335
141
  },
142
  {
143
  "step": 360,
144
- "loss": 0.9127
145
  },
146
  {
147
  "step": 370,
148
- "loss": 0.8907
149
  },
150
  {
151
  "step": 380,
152
- "loss": 0.8504
153
  },
154
  {
155
  "step": 390,
156
- "loss": 0.9536
157
  },
158
  {
159
  "step": 400,
160
- "loss": 0.8082
161
  },
162
  {
163
  "step": 410,
164
- "loss": 0.8522
165
  },
166
  {
167
  "step": 420,
168
- "loss": 0.8181
169
  },
170
  {
171
  "step": 430,
172
- "loss": 0.7697
173
  },
174
  {
175
  "step": 440,
176
- "loss": 0.8197
177
  },
178
  {
179
  "step": 450,
180
- "loss": 0.8189
181
  },
182
  {
183
  "step": 460,
184
- "loss": 0.7979
185
  },
186
  {
187
  "step": 470,
188
- "loss": 0.8282
189
  },
190
  {
191
  "step": 480,
192
- "loss": 0.8882
193
  },
194
  {
195
  "step": 490,
196
- "loss": 0.8076
197
  },
198
  {
199
  "step": 500,
200
- "loss": 0.799
201
  },
202
  {
203
  "step": 510,
204
- "loss": 0.6938
205
  },
206
  {
207
  "step": 520,
208
- "loss": 0.7809
209
  },
210
  {
211
  "step": 530,
212
- "loss": 0.7753
213
  },
214
  {
215
  "step": 540,
216
- "loss": 0.7249
217
  },
218
  {
219
  "step": 550,
220
- "loss": 0.7071
221
  },
222
  {
223
  "step": 560,
224
- "loss": 0.6511
225
  },
226
  {
227
  "step": 570,
228
- "loss": 0.6253
229
  },
230
  {
231
  "step": 580,
232
- "loss": 0.6207
233
  },
234
  {
235
  "step": 590,
236
- "loss": 0.6019
237
  },
238
  {
239
  "step": 600,
240
- "loss": 0.5924
241
  },
242
  {
243
  "step": 610,
244
- "loss": 0.5868
245
  },
246
  {
247
  "step": 620,
248
- "loss": 0.5878
249
  },
250
  {
251
  "step": 630,
252
- "loss": 0.5844
253
  },
254
  {
255
  "step": 640,
256
- "loss": 0.592
257
  },
258
  {
259
  "step": 650,
260
- "loss": 0.5673
261
  },
262
  {
263
  "step": 660,
264
- "loss": 0.5592
265
  },
266
  {
267
  "step": 670,
268
- "loss": 0.6151
269
  },
270
  {
271
  "step": 680,
272
- "loss": 0.5323
273
  },
274
  {
275
  "step": 690,
276
- "loss": 0.5866
277
  },
278
  {
279
  "step": 700,
280
- "loss": 0.5334
281
  },
282
  {
283
  "step": 710,
284
- "loss": 0.5482
285
  },
286
  {
287
  "step": 720,
288
- "loss": 0.5439
289
  },
290
  {
291
  "step": 730,
292
- "loss": 0.5287
293
  },
294
  {
295
  "step": 740,
296
- "loss": 0.6061
297
  },
298
  {
299
  "step": 750,
300
- "loss": 0.5285
301
  },
302
  {
303
  "step": 760,
304
- "loss": 0.5141
305
  },
306
  {
307
  "step": 770,
308
- "loss": 0.4986
309
  },
310
  {
311
  "step": 780,
312
- "loss": 0.5414
313
  },
314
  {
315
  "step": 790,
316
- "loss": 0.5625
317
  },
318
  {
319
  "step": 800,
320
- "loss": 0.5384
321
  },
322
  {
323
  "step": 810,
324
- "loss": 0.5576
325
  },
326
  {
327
  "step": 820,
328
- "loss": 0.5088
329
  },
330
  {
331
  "step": 830,
332
- "loss": 0.5248
333
  },
334
  {
335
  "step": 840,
336
- "loss": 0.5242
337
  },
338
  {
339
  "step": 850,
340
- "loss": 0.4592
341
  },
342
  {
343
  "step": 860,
344
- "loss": 0.5213
345
  },
346
  {
347
  "step": 870,
348
- "loss": 0.4535
349
  },
350
  {
351
  "step": 880,
352
- "loss": 0.5557
353
  },
354
  {
355
  "step": 890,
356
- "loss": 0.5018
357
  },
358
  {
359
  "step": 900,
360
- "loss": 0.5108
361
  },
362
  {
363
  "step": 910,
364
- "loss": 0.4915
365
  },
366
  {
367
  "step": 920,
368
- "loss": 0.4874
369
  },
370
  {
371
  "step": 930,
372
- "loss": 0.5796
373
  },
374
  {
375
  "step": 940,
376
- "loss": 0.4931
377
  },
378
  {
379
  "step": 950,
380
- "loss": 0.4407
381
  },
382
  {
383
  "step": 960,
384
- "loss": 0.4776
385
  },
386
  {
387
  "step": 970,
388
- "loss": 0.4795
389
  },
390
  {
391
  "step": 980,
392
- "loss": 0.4901
393
  },
394
  {
395
  "step": 990,
396
- "loss": 0.5025
397
  },
398
  {
399
  "step": 1000,
400
- "loss": 0.4933
401
- },
402
- {
403
- "step": 1010,
404
- "loss": 0.5486
405
- },
406
- {
407
- "step": 1020,
408
- "loss": 0.52
409
- },
410
- {
411
- "step": 1030,
412
- "loss": 0.4893
413
- },
414
- {
415
- "step": 1040,
416
- "loss": 0.4921
417
- },
418
- {
419
- "step": 1050,
420
- "loss": 0.4784
421
- },
422
- {
423
- "step": 1060,
424
- "loss": 0.4854
425
- },
426
- {
427
- "step": 1070,
428
- "loss": 0.5374
429
- },
430
- {
431
- "step": 1080,
432
- "loss": 0.4991
433
- },
434
- {
435
- "step": 1090,
436
- "loss": 0.5092
437
- },
438
- {
439
- "step": 1100,
440
- "loss": 0.5146
441
- },
442
- {
443
- "step": 1110,
444
- "loss": 0.5591
445
- },
446
- {
447
- "step": 1120,
448
- "loss": 0.521
449
- },
450
- {
451
- "step": 1130,
452
- "loss": 0.4831
453
- },
454
- {
455
- "step": 1140,
456
- "loss": 0.4785
457
- },
458
- {
459
- "step": 1150,
460
- "loss": 0.5337
461
- },
462
- {
463
- "step": 1160,
464
- "loss": 0.4591
465
- },
466
- {
467
- "step": 1170,
468
- "loss": 0.5437
469
- },
470
- {
471
- "step": 1180,
472
- "loss": 0.5602
473
- },
474
- {
475
- "step": 1190,
476
- "loss": 0.4957
477
- },
478
- {
479
- "step": 1200,
480
- "loss": 0.5573
481
  }
482
  ]
 
1
  [
2
  {
3
  "step": 10,
4
+ "loss": 2.4541
5
  },
6
  {
7
  "step": 20,
8
+ "loss": 2.1867
9
  },
10
  {
11
  "step": 30,
12
+ "loss": 1.4349
13
  },
14
  {
15
  "step": 40,
16
+ "loss": 0.9306
17
  },
18
  {
19
  "step": 50,
20
+ "loss": 0.7783
21
  },
22
  {
23
  "step": 60,
24
+ "loss": 0.6622
25
  },
26
  {
27
  "step": 70,
28
+ "loss": 0.5654
29
  },
30
  {
31
  "step": 80,
32
+ "loss": 0.5339
33
  },
34
  {
35
  "step": 90,
36
+ "loss": 0.467
37
  },
38
  {
39
  "step": 100,
40
+ "loss": 0.4574
41
  },
42
  {
43
  "step": 110,
44
+ "loss": 0.4523
45
  },
46
  {
47
  "step": 120,
48
+ "loss": 0.4217
49
  },
50
  {
51
  "step": 130,
52
+ "loss": 0.4343
53
  },
54
  {
55
  "step": 140,
56
+ "loss": 0.4261
57
  },
58
  {
59
  "step": 150,
60
+ "loss": 0.4277
61
  },
62
  {
63
  "step": 160,
64
+ "loss": 0.3847
65
  },
66
  {
67
  "step": 170,
68
+ "loss": 0.344
69
  },
70
  {
71
  "step": 180,
72
+ "loss": 0.3867
73
  },
74
  {
75
  "step": 190,
76
+ "loss": 0.3597
77
  },
78
  {
79
  "step": 200,
80
+ "loss": 0.3223
81
  },
82
  {
83
  "step": 210,
84
+ "loss": 0.323
85
  },
86
  {
87
  "step": 220,
88
+ "loss": 0.3337
89
  },
90
  {
91
  "step": 230,
92
+ "loss": 0.2679
93
  },
94
  {
95
  "step": 240,
96
+ "loss": 0.3112
97
  },
98
  {
99
  "step": 250,
100
+ "loss": 0.3013
101
  },
102
  {
103
  "step": 260,
104
+ "loss": 0.2929
105
  },
106
  {
107
  "step": 270,
108
+ "loss": 0.27
109
  },
110
  {
111
  "step": 280,
112
+ "loss": 0.3208
113
  },
114
  {
115
  "step": 290,
116
+ "loss": 0.2797
117
  },
118
  {
119
  "step": 300,
120
+ "loss": 0.2468
121
  },
122
  {
123
  "step": 310,
124
+ "loss": 0.27
125
  },
126
  {
127
  "step": 320,
128
+ "loss": 0.2513
129
  },
130
  {
131
  "step": 330,
132
+ "loss": 0.254
133
  },
134
  {
135
  "step": 340,
136
+ "loss": 0.2899
137
  },
138
  {
139
  "step": 350,
140
+ "loss": 0.2807
141
  },
142
  {
143
  "step": 360,
144
+ "loss": 0.2676
145
  },
146
  {
147
  "step": 370,
148
+ "loss": 0.2495
149
  },
150
  {
151
  "step": 380,
152
+ "loss": 0.2172
153
  },
154
  {
155
  "step": 390,
156
+ "loss": 0.2786
157
  },
158
  {
159
  "step": 400,
160
+ "loss": 0.2147
161
  },
162
  {
163
  "step": 410,
164
+ "loss": 0.235
165
  },
166
  {
167
  "step": 420,
168
+ "loss": 0.2239
169
  },
170
  {
171
  "step": 430,
172
+ "loss": 0.1885
173
  },
174
  {
175
  "step": 440,
176
+ "loss": 0.2431
177
  },
178
  {
179
  "step": 450,
180
+ "loss": 0.2412
181
  },
182
  {
183
  "step": 460,
184
+ "loss": 0.2341
185
  },
186
  {
187
  "step": 470,
188
+ "loss": 0.23
189
  },
190
  {
191
  "step": 480,
192
+ "loss": 0.2684
193
  },
194
  {
195
  "step": 490,
196
+ "loss": 0.197
197
  },
198
  {
199
  "step": 500,
200
+ "loss": 0.2476
201
  },
202
  {
203
  "step": 510,
204
+ "loss": 0.1719
205
  },
206
  {
207
  "step": 520,
208
+ "loss": 0.2302
209
  },
210
  {
211
  "step": 530,
212
+ "loss": 0.2177
213
  },
214
  {
215
  "step": 540,
216
+ "loss": 0.2076
217
  },
218
  {
219
  "step": 550,
220
+ "loss": 0.2235
221
  },
222
  {
223
  "step": 560,
224
+ "loss": 0.2208
225
  },
226
  {
227
  "step": 570,
228
+ "loss": 0.1932
229
  },
230
  {
231
  "step": 580,
232
+ "loss": 0.1919
233
  },
234
  {
235
  "step": 590,
236
+ "loss": 0.1824
237
  },
238
  {
239
  "step": 600,
240
+ "loss": 0.2221
241
  },
242
  {
243
  "step": 610,
244
+ "loss": 0.2139
245
  },
246
  {
247
  "step": 620,
248
+ "loss": 0.1968
249
  },
250
  {
251
  "step": 630,
252
+ "loss": 0.1999
253
  },
254
  {
255
  "step": 640,
256
+ "loss": 0.1835
257
  },
258
  {
259
  "step": 650,
260
+ "loss": 0.1981
261
  },
262
  {
263
  "step": 660,
264
+ "loss": 0.2057
265
  },
266
  {
267
  "step": 670,
268
+ "loss": 0.2158
269
  },
270
  {
271
  "step": 680,
272
+ "loss": 0.1915
273
  },
274
  {
275
  "step": 690,
276
+ "loss": 0.2286
277
  },
278
  {
279
  "step": 700,
280
+ "loss": 0.1697
281
  },
282
  {
283
  "step": 710,
284
+ "loss": 0.1912
285
  },
286
  {
287
  "step": 720,
288
+ "loss": 0.1923
289
  },
290
  {
291
  "step": 730,
292
+ "loss": 0.1601
293
  },
294
  {
295
  "step": 740,
296
+ "loss": 0.215
297
  },
298
  {
299
  "step": 750,
300
+ "loss": 0.1742
301
  },
302
  {
303
  "step": 760,
304
+ "loss": 0.1408
305
  },
306
  {
307
  "step": 770,
308
+ "loss": 0.1484
309
  },
310
  {
311
  "step": 780,
312
+ "loss": 0.1607
313
  },
314
  {
315
  "step": 790,
316
+ "loss": 0.1571
317
  },
318
  {
319
  "step": 800,
320
+ "loss": 0.1546
321
  },
322
  {
323
  "step": 810,
324
+ "loss": 0.1793
325
  },
326
  {
327
  "step": 820,
328
+ "loss": 0.1523
329
  },
330
  {
331
  "step": 830,
332
+ "loss": 0.1682
333
  },
334
  {
335
  "step": 840,
336
+ "loss": 0.1696
337
  },
338
  {
339
  "step": 850,
340
+ "loss": 0.1418
341
  },
342
  {
343
  "step": 860,
344
+ "loss": 0.1621
345
  },
346
  {
347
  "step": 870,
348
+ "loss": 0.1361
349
  },
350
  {
351
  "step": 880,
352
+ "loss": 0.1692
353
  },
354
  {
355
  "step": 890,
356
+ "loss": 0.1589
357
  },
358
  {
359
  "step": 900,
360
+ "loss": 0.1663
361
  },
362
  {
363
  "step": 910,
364
+ "loss": 0.1743
365
  },
366
  {
367
  "step": 920,
368
+ "loss": 0.1606
369
  },
370
  {
371
  "step": 930,
372
+ "loss": 0.1948
373
  },
374
  {
375
  "step": 940,
376
+ "loss": 0.1563
377
  },
378
  {
379
  "step": 950,
380
+ "loss": 0.1554
381
  },
382
  {
383
  "step": 960,
384
+ "loss": 0.1452
385
  },
386
  {
387
  "step": 970,
388
+ "loss": 0.1534
389
  },
390
  {
391
  "step": 980,
392
+ "loss": 0.1431
393
  },
394
  {
395
  "step": 990,
396
+ "loss": 0.154
397
  },
398
  {
399
  "step": 1000,
400
+ "loss": 0.1428
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
401
  }
402
  ]
adapter/eval_plots/plot_01_train_val_loss.png CHANGED
adapter/eval_plots/plot_02_loss_smoothed.png CHANGED
adapter/eval_plots/plot_03_overall_metrics.png CHANGED
adapter/eval_plots/plot_04_per_category.png CHANGED
adapter/eval_plots/plot_05_category_response_time.png CHANGED
adapter/eval_plots/plot_06_rouge_heatmap.png CHANGED

Git LFS Details

  • SHA256: 9c614313adb00df800910b42748b35513760c21a8a99fa4fb48d20b67d6bc49a
  • Pointer size: 131 Bytes
  • Size of remote file: 134 kB

Git LFS Details

  • SHA256: 8d0ffba01ddbbd969a50e09a582c65511f257015f895ca5ed77202a715abc3d3
  • Pointer size: 131 Bytes
  • Size of remote file: 138 kB
adapter/eval_plots/plot_07_keyword_format_match.png CHANGED

Git LFS Details

  • SHA256: 7fce46baf9af29630f717f41a033ca682aac66f746f0e67965c8e0442fd8878f
  • Pointer size: 131 Bytes
  • Size of remote file: 184 kB

Git LFS Details

  • SHA256: 089b7c4ba7593c77a9dd91a5d4bd221ebcd0fa04e48b290f86ea8215392f1bef
  • Pointer size: 131 Bytes
  • Size of remote file: 184 kB
adapter/eval_plots/plot_08_response_times.png CHANGED

Git LFS Details

  • SHA256: 9343352aa20bd54fcc708ec1aad8b602aaf3d19568e1186f7624ed82540b7bfb
  • Pointer size: 131 Bytes
  • Size of remote file: 171 kB

Git LFS Details

  • SHA256: 3403f777ec2ce672b9b51386519f50d6c81ae7ff0a030ca6f16431af68838c92
  • Pointer size: 131 Bytes
  • Size of remote file: 173 kB
adapter/eval_plots/plot_09_token_distribution.png CHANGED
adapter/eval_plots/plot_10_confusion_matrix.png CHANGED
adapter/eval_plots/plot_11_radar_chart.png CHANGED

Git LFS Details

  • SHA256: 32b571ed0646264ae2c6e9d67812126f5f7fe64f37c45c7ab90ab98c235a32d8
  • Pointer size: 131 Bytes
  • Size of remote file: 160 kB

Git LFS Details

  • SHA256: 8a63891a8dc3afac220d55e012b1080eef6023fc6c3a110b465144ee71ee3c35
  • Pointer size: 131 Bytes
  • Size of remote file: 162 kB
adapter/eval_plots/plot_12_dashboard.png CHANGED

Git LFS Details

  • SHA256: 8ef01c5f1f23121be7abb8a670513747d055584aa6dc2a6d4d569e31431dc4d9
  • Pointer size: 131 Bytes
  • Size of remote file: 120 kB

Git LFS Details

  • SHA256: 134db8ab52a4aa5402a08940b7dca1101ec5bdf656e1a980b3036a67cd3f4863
  • Pointer size: 131 Bytes
  • Size of remote file: 114 kB