File size: 179,773 Bytes
9afb00f | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 101 102 103 104 105 106 107 108 109 110 111 112 113 114 115 116 117 118 119 120 121 122 123 124 125 126 127 128 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 148 149 150 151 152 153 154 155 156 157 158 159 160 161 162 163 164 165 166 167 168 169 170 171 172 173 174 175 176 177 178 179 180 181 182 183 184 185 186 187 188 189 190 191 192 193 194 195 196 197 198 199 200 201 202 203 204 205 206 207 208 209 210 211 212 213 214 215 216 217 218 219 220 221 222 223 224 225 226 227 228 229 230 231 232 233 234 235 236 237 238 239 240 241 242 243 244 245 246 247 248 249 250 251 252 253 254 255 256 257 258 259 260 261 262 263 264 265 266 267 268 269 270 271 | {"sample_id": "E001", "dataset": "entities", "input": "محمد صلاح لاعب كرة قدم مصري", "expected": "محمد صلاح لاعب كرة قدم مصري", "pipeline_output": "محمد صلاح لاعب كرة قدم مصري", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 769, "punctuation_ms": 536, "spelling_ms": 671, "total_ms": 1978}, "telemetry_events": [{"event": "grammar_raw_output", "input": "محمد صلاح لاعب كرة قدم مصري", "output": "محمد صلاح لاعب كرة قدم مصري"}]}
{"sample_id": "E002", "dataset": "entities", "input": "عبدالله يدرس في الجامعة", "expected": "عبدالله يدرس في الجامعة", "pipeline_output": "عبد الله يدرس في الجامعة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 689, "punctuation_ms": 450, "spelling_ms": 503, "total_ms": 1644}, "telemetry_events": [{"event": "grammar_raw_output", "input": "عبد الله يدرس في الجامعة", "output": "عبد الله يدرس في الجامعة"}]}
{"sample_id": "E003", "dataset": "entities", "input": "عبد الرحمن أخي الأكبر", "expected": "عبد الرحمن أخي الأكبر", "pipeline_output": "عبد الرحمن أخي الأكبر", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 580, "punctuation_ms": 411, "spelling_ms": 541, "total_ms": 1534}, "telemetry_events": [{"event": "grammar_raw_output", "input": "عبد الرحمن أخي الأكبر", "output": "عبد الرحمن أخي الأكبر"}]}
{"sample_id": "E004", "dataset": "entities", "input": "أحمد محمود يعمل مهندساً", "expected": "أحمد محمود يعمل مهندساً", "pipeline_output": "أحمد محمود يعمل مهندساً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 730, "punctuation_ms": 430, "spelling_ms": 1666, "total_ms": 2829}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أحمد محمود يعمل مهندساً", "output": "أحمد محمود يعمل مهندسا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "مهندسا", "end": 23, "event": "grammar_diff", "original": "مهندساً", "start": 16}, {"correction": "مهندسا", "event": "filter_reject", "filter": "TanweenGuard", "original": "مهندساً"}]}
{"sample_id": "E005", "dataset": "entities", "input": "الدكتور حسن علي أستاذ جامعي", "expected": "الدكتور حسن علي أستاذ جامعي", "pipeline_output": "الدكتور حسن علي أستاذ جامعي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 594, "punctuation_ms": 381, "spelling_ms": 2250, "total_ms": 3226}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الدكتور حسن علي أستاذ جامعي", "output": "الدكتور حسن علي أستاذ جامعي"}]}
{"sample_id": "E006", "dataset": "entities", "input": "السيدة فاطمة الزهراء معلمة", "expected": "السيدة فاطمة الزهراء معلمة", "pipeline_output": "السيدة فاطمة الزهراء معلمة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 487, "punctuation_ms": 629, "spelling_ms": 2520, "total_ms": 3637}, "telemetry_events": [{"event": "grammar_raw_output", "input": "السيدة فاطمة الزهراء معلمة", "output": "السيدة فاطمة الزهراء معلمة"}]}
{"sample_id": "E007", "dataset": "entities", "input": "الأستاذ عمر بن الخطاب عادل", "expected": "الأستاذ عمر بن الخطاب عادل", "pipeline_output": "الأستاذ عمر بن الخطاب عادل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 687, "punctuation_ms": 790, "spelling_ms": 2198, "total_ms": 3677}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الأستاذ عمر بن الخطاب عادل", "output": "الأستاذ عمر بن الخطاب عادل"}]}
{"sample_id": "E008", "dataset": "entities", "input": "خالد بن الوليد قائد عظيم", "expected": "خالد بن الوليد قائد عظيم", "pipeline_output": "خالد بن الوليد قائد عظيم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 686, "punctuation_ms": 479, "spelling_ms": 2516, "total_ms": 3682}, "telemetry_events": [{"event": "grammar_raw_output", "input": "خالد بن الوليد قائد عظيم", "output": "خالد بن الوليد قائد عظيم"}]}
{"sample_id": "E009", "dataset": "entities", "input": "صلاح الدين الأيوبي حرر القدس", "expected": "صلاح الدين الأيوبي حرر القدس", "pipeline_output": "صلاح الدين الأيوبي حرر القدس", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 641, "punctuation_ms": 592, "spelling_ms": 2674, "total_ms": 3909}, "telemetry_events": [{"event": "grammar_raw_output", "input": "صلاح الدين الأيوبي حرر القدس", "output": "صلاح الدين الأيوبي حرر القدس"}]}
{"sample_id": "E010", "dataset": "entities", "input": "ابن سينا عالم عربي مشهور", "expected": "ابن سينا عالم عربي مشهور", "pipeline_output": "ابن سينا عالم عربي مشهور", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 640, "punctuation_ms": 534, "spelling_ms": 2540, "total_ms": 3716}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ابن سينا عالم عربي مشهور", "output": "ابن سينا عالم عربي مشهور"}]}
{"sample_id": "E011", "dataset": "entities", "input": "جامعة القاهرة من أعرق الجامعات", "expected": "جامعة القاهرة من أعرق الجامعات", "pipeline_output": "جامعة القاهرة من أعرق الجامعات", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 694, "punctuation_ms": 641, "spelling_ms": 2717, "total_ms": 4054}, "telemetry_events": [{"event": "grammar_raw_output", "input": "جامعة القاهرة من أعرق الجامعات", "output": "جامعة القاهرة من أعرق الجامعات"}]}
{"sample_id": "E012", "dataset": "entities", "input": "مدينة الرياض عاصمة المملكة", "expected": "مدينة الرياض عاصمة المملكة", "pipeline_output": "مدينة الرياض عاصمة المملكة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 541, "punctuation_ms": 634, "spelling_ms": 2085, "total_ms": 3262}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مدينة الرياض عاصمة المملكة", "output": "مدينة الرياض عاصمة المملكة"}]}
{"sample_id": "E013", "dataset": "entities", "input": "دبي مدينة عصرية وجميلة", "expected": "دبي مدينة عصرية وجميلة", "pipeline_output": "دبي مدينة عصرية وجميلة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 595, "punctuation_ms": 530, "spelling_ms": 1709, "total_ms": 2835}, "telemetry_events": [{"event": "grammar_raw_output", "input": "دبي مدينة عصرية وجميلة", "output": "دبي مدينة عصرية وجميلة"}]}
{"sample_id": "E014", "dataset": "entities", "input": "القدس مدينة مقدسة عند المسلمين", "expected": "القدس مدينة مقدسة عند المسلمين", "pipeline_output": "القدس مدينة مقدسة عند المسلمين", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 602, "punctuation_ms": 714, "spelling_ms": 2240, "total_ms": 3557}, "telemetry_events": [{"event": "grammar_raw_output", "input": "القدس مدينة مقدسة عند المسلمين", "output": "القدس مدينة مقدسة عند المسلمين"}]}
{"sample_id": "E015", "dataset": "entities", "input": "مكة المكرمة أطهر البقاع", "expected": "مكة المكرمة أطهر البقاع", "pipeline_output": "مكة المكرمة أطهر البقاع", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 633, "punctuation_ms": 533, "spelling_ms": 2803, "total_ms": 3970}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مكة المكرمة أطهر البقاع", "output": "مكة المكرمة أطهر البقاع"}]}
{"sample_id": "E016", "dataset": "entities", "input": "المدينة المنورة طابة الطيبة", "expected": "المدينة المنورة طابة الطيبة", "pipeline_output": "المدينة المنورة طابة طيبة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 594, "punctuation_ms": 504, "spelling_ms": 2040, "total_ms": 3141}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المدينة المنورة طابة الطيبة", "output": "المدينة المنورة طابة طيبة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "طيبة", "end": 27, "event": "grammar_diff", "original": "الطيبة", "start": 21}, {"correction": "طيبة", "end": 27, "event": "patch_accepted", "original": "الطيبة", "stage": "grammar", "start": 21}]}
{"sample_id": "E017", "dataset": "entities", "input": "بغداد عاصمة العراق", "expected": "بغداد عاصمة العراق", "pipeline_output": "بغداد عاصمة العراق", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 430, "punctuation_ms": 451, "spelling_ms": 1660, "total_ms": 2543}, "telemetry_events": [{"event": "grammar_raw_output", "input": "بغداد عاصمة العراق", "output": "بغداد عاصمة العراق"}]}
{"sample_id": "E018", "dataset": "entities", "input": "دمشق أقدم عاصمة في التاريخ", "expected": "دمشق أقدم عاصمة في التاريخ", "pipeline_output": "دمشق أقدم عاصمة في التاريخ", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 582, "punctuation_ms": 417, "spelling_ms": 3417, "total_ms": 4418}, "telemetry_events": [{"event": "grammar_raw_output", "input": "دمشق أقدم عاصمة في التاريخ", "output": "دمشق أقدم عاصمة في التاريخ"}]}
{"sample_id": "E019", "dataset": "entities", "input": "شركة OpenAI تطور الذكاء الاصطناعي", "expected": "شركة OpenAI تطور الذكاء الاصطناعي", "pipeline_output": "شركة OpenAI تطور الذكاء الاصطناعي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 684, "punctuation_ms": 576, "spelling_ms": 0, "total_ms": 1261}, "telemetry_events": [{"event": "grammar_raw_output", "input": "شركة OpenAI تطور الذكاء الاصطناعي", "output": "شركة OpenAI تطور الذكاء الاصطناعي"}]}
{"sample_id": "E020", "dataset": "entities", "input": "شركة Google عملاق التقنية", "expected": "شركة Google عملاق التقنية", "pipeline_output": "شركة Google عملاق التقنية", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 483, "punctuation_ms": 402, "spelling_ms": 0, "total_ms": 886}, "telemetry_events": [{"event": "grammar_raw_output", "input": "شركة Google عملاق التقنية", "output": "شركة Google عملاق التقنية"}]}
{"sample_id": "E021", "dataset": "entities", "input": "شركة Microsoft تنتج البرمجيات", "expected": "شركة Microsoft تنتج البرمجيات", "pipeline_output": "شركة Microsoft تنتج البرمجيات", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 536, "punctuation_ms": 468, "spelling_ms": 0, "total_ms": 1006}, "telemetry_events": [{"event": "grammar_raw_output", "input": "شركة Microsoft تنتج البرمجيات", "output": "شركة Microsoft تنتج البرمجيات"}]}
{"sample_id": "E022", "dataset": "entities", "input": "منصة GitHub للمطورين", "expected": "منصة GitHub للمطورين", "pipeline_output": "منصة GitHub للمطورين", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 976, "punctuation_ms": 585, "spelling_ms": 0, "total_ms": 1562}, "telemetry_events": [{"event": "grammar_raw_output", "input": "منصة GitHub للمطورين", "output": "منصة GitHuب للمطورين"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "GitHuب", "end": 11, "event": "grammar_diff", "original": "GitHub", "start": 5}, {"correction": "GitHuب", "event": "filter_reject", "filter": "LatinGuard", "original": "GitHub"}]}
{"sample_id": "E023", "dataset": "entities", "input": "شركة Tesla للسيارات الكهربائية", "expected": "شركة Tesla للسيارات الكهربائية", "pipeline_output": "شركة Tesla للسيارات الكهربائية", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 686, "punctuation_ms": 663, "spelling_ms": 0, "total_ms": 1350}, "telemetry_events": [{"event": "grammar_raw_output", "input": "شركة Tesla للسيارات الكهربائية", "output": "شركة Teسla للسيارات الكهربائية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "Teسla", "end": 10, "event": "grammar_diff", "original": "Tesla", "start": 5}, {"correction": "Teسla", "event": "filter_reject", "filter": "LatinGuard", "original": "Tesla"}]}
{"sample_id": "E024", "dataset": "entities", "input": "أستخدم Python في البرمجة", "expected": "أستخدم Python في البرمجة", "pipeline_output": "أستخدمت Python في البرمجة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 582, "punctuation_ms": 636, "spelling_ms": 0, "total_ms": 1220}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أستخدم Python في البرمجة", "output": "أستخدمت Python في البرمجة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "أستخدمت", "end": 6, "event": "grammar_diff", "original": "أستخدم", "start": 0}, {"correction": "أستخدمت", "end": 6, "event": "patch_accepted", "original": "أستخدم", "stage": "grammar", "start": 0}]}
{"sample_id": "E025", "dataset": "entities", "input": "إطار TensorFlow مفيد للتعلم", "expected": "إطار TensorFlow مفيد للتعلم", "pipeline_output": "إطار TensorFlow مفيد للتعلم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 728, "punctuation_ms": 759, "spelling_ms": 0, "total_ms": 1489}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إطار TensorFlow مفيد للتعلم", "output": "إطار TensorFlow مفيد للتعلم"}]}
{"sample_id": "E026", "dataset": "entities", "input": "مكتبة PyTorch للتعلم العميق", "expected": "مكتبة PyTorch للتعلم العميق", "pipeline_output": "مكتبة PyTorch للتعلم العميق", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 678, "punctuation_ms": 719, "spelling_ms": 0, "total_ms": 1398}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مكتبة PyTorch للتعلم العميق", "output": "مكتبة PyTorch للتعلم العميق"}]}
{"sample_id": "E027", "dataset": "entities", "input": "منصة Node.js للخوادم", "expected": "منصة Node.js للخوادم", "pipeline_output": "منصة Node.js للخوادم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 931, "punctuation_ms": 578, "spelling_ms": 0, "total_ms": 1511}, "telemetry_events": [{"event": "grammar_raw_output", "input": "منصة Node.js للخوادم", "output": "منصة Node ، jة للخوادم"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "Node ، jة", "end": 12, "event": "grammar_diff", "original": "Node.js", "start": 5}, {"correction": "Node ، jة", "event": "filter_reject", "filter": "LatinGuard", "original": "Node.js"}]}
{"sample_id": "E028", "dataset": "entities", "input": "لغة JavaScript للويب", "expected": "لغة JavaScript للويب", "pipeline_output": "لغة JavaScript للويب", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 585, "punctuation_ms": 535, "spelling_ms": 0, "total_ms": 1121}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لغة JavaScript للويب", "output": "لغة JavaScript للويب"}]}
{"sample_id": "E029", "dataset": "entities", "input": "قاعدة بيانات MongoDB جيدة", "expected": "قاعدة بيانات MongoDB جيدة", "pipeline_output": "قاعدة بيانات MongoDB جيدة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 687, "punctuation_ms": 502, "spelling_ms": 0, "total_ms": 1190}, "telemetry_events": [{"event": "grammar_raw_output", "input": "قاعدة بيانات MongoDB جيدة", "output": "قاعدة بيانات MongoDB جيدة"}]}
{"sample_id": "E030", "dataset": "entities", "input": "خدمة Docker للحاويات", "expected": "خدمة Docker للحاويات", "pipeline_output": "خدمة Docker للحاويات", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 680, "punctuation_ms": 512, "spelling_ms": 0, "total_ms": 1193}, "telemetry_events": [{"event": "grammar_raw_output", "input": "خدمة Docker للحاويات", "output": "خدمة Docker للحاويات"}]}
{"sample_id": "G001", "dataset": "grammar", "input": "البنات ذهب إلى المدرسة", "expected": "البنات ذهب إلى المدرسة", "pipeline_output": "البنات ذهبن إلى المدرسة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 582, "punctuation_ms": 552, "spelling_ms": 1614, "total_ms": 2750}, "telemetry_events": [{"event": "grammar_raw_output", "input": "البنات ذهب إلى المدرسة", "output": "البنات ذهبن إلى المدرسة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "ذهبن", "end": 10, "event": "grammar_diff", "original": "ذهب", "start": 7}, {"correction": "ذهبن", "end": 10, "event": "patch_accepted", "original": "ذهب", "stage": "grammar", "start": 7}]}
{"sample_id": "G002", "dataset": "grammar", "input": "الطلاب يذهب إلى الجامعة", "expected": "الطلاب يذهب إلى الجامعة", "pipeline_output": "الطلاب يذهبون إلى الجامعة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 637, "punctuation_ms": 411, "spelling_ms": 1442, "total_ms": 2493}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الطلاب يذهب إلى الجامعة", "output": "الطلاب يذهبون إلى الجامعة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يذهبون", "end": 11, "event": "grammar_diff", "original": "يذهب", "start": 7}, {"correction": "يذهبون", "end": 11, "event": "patch_accepted", "original": "يذهب", "stage": "grammar", "start": 7}]}
{"sample_id": "G003", "dataset": "grammar", "input": "المهندسون حضر الاجتماع", "expected": "المهندسون حضر الاجتماع", "pipeline_output": "المهندسون حضرون الاجتماع", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 477, "punctuation_ms": 621, "spelling_ms": 1609, "total_ms": 2709}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المهندسون حضر الاجتماع", "output": "المهندسون حضرون الاجتماع"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "حضرون", "end": 13, "event": "grammar_diff", "original": "حضر", "start": 10}, {"correction": "حضرون", "end": 13, "event": "patch_accepted", "original": "حضر", "stage": "grammar", "start": 10}]}
{"sample_id": "G004", "dataset": "grammar", "input": "الرجال يعمل في المصنع", "expected": "الرجال يعمل في المصنع", "pipeline_output": "الرجال يعملون في المصنع", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 581, "punctuation_ms": 604, "spelling_ms": 1672, "total_ms": 2860}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الرجال يعمل في المصنع", "output": "الرجال يعملون في المصنع"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يعملون", "end": 11, "event": "grammar_diff", "original": "يعمل", "start": 7}, {"correction": "يعملون", "end": 11, "event": "patch_accepted", "original": "يعمل", "stage": "grammar", "start": 7}]}
{"sample_id": "G005", "dataset": "grammar", "input": "النساء ذهب إلى السوق", "expected": "النساء ذهب إلى السوق", "pipeline_output": "النساء ذهبن إلى السوق", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 591, "punctuation_ms": 491, "spelling_ms": 1821, "total_ms": 2904}, "telemetry_events": [{"event": "grammar_raw_output", "input": "النساء ذهب إلى السوق", "output": "النساء ذهبن إلى السوق"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "ذهبن", "end": 10, "event": "grammar_diff", "original": "ذهب", "start": 7}, {"correction": "ذهبن", "end": 10, "event": "patch_accepted", "original": "ذهب", "stage": "grammar", "start": 7}]}
{"sample_id": "G006", "dataset": "grammar", "input": "الأولاد لعب في الحديقة", "expected": "الأولاد لعب في الحديقة", "pipeline_output": "الأولاد لعب في الحديقة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 584, "punctuation_ms": 538, "spelling_ms": 1588, "total_ms": 2712}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الأولاد لعب في الحديقة", "output": "الأولاد لعبوَ في الحديقة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "لعبوَ", "end": 11, "event": "grammar_diff", "original": "لعب", "start": 8}, {"correction": "لعبوَ", "event": "filter_reject", "filter": "IVtoOOV", "original": "لعب"}]}
{"sample_id": "G007", "dataset": "grammar", "input": "المعلمات حضر الاجتماع", "expected": "المعلمات حضر الاجتماع", "pipeline_output": "المعلمات حضرن الاجتماع", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 481, "punctuation_ms": 566, "spelling_ms": 2051, "total_ms": 3100}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المعلمات حضر الاجتماع", "output": "المعلمات حضرن الاجتماع"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "حضرن", "end": 12, "event": "grammar_diff", "original": "حضر", "start": 9}, {"correction": "حضرن", "end": 12, "event": "patch_accepted", "original": "حضر", "stage": "grammar", "start": 9}]}
{"sample_id": "G008", "dataset": "grammar", "input": "الأطباء يعالج المرضى", "expected": "الأطباء يعالج المرضى", "pipeline_output": "الأطباء يعالجون المرضى", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 528, "punctuation_ms": 489, "spelling_ms": 1257, "total_ms": 2276}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الأطباء يعالج المرضى", "output": "الأطباء يعالجون المرضى"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يعالجون", "end": 13, "event": "grammar_diff", "original": "يعالج", "start": 8}, {"correction": "يعالجون", "end": 13, "event": "patch_accepted", "original": "يعالج", "stage": "grammar", "start": 8}]}
{"sample_id": "G009", "dataset": "grammar", "input": "العمال بنى المبنى", "expected": "العمال بنى المبنى", "pipeline_output": "العمال بنى المبنى", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 484, "punctuation_ms": 436, "spelling_ms": 1767, "total_ms": 2689}, "telemetry_events": [{"event": "grammar_raw_output", "input": "العمال بنى المبنى", "output": "العمال بنى المبنى"}]}
{"sample_id": "G010", "dataset": "grammar", "input": "الطالبات كتب الواجب", "expected": "الطالبات كتب الواجب", "pipeline_output": "الطالبات كتبن الواجب", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 433, "punctuation_ms": 477, "spelling_ms": 3352, "total_ms": 4264}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الطالبات كتب الواجب", "output": "الطالبات كتبن الواجب"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "كتبن", "end": 12, "event": "grammar_diff", "original": "كتب", "start": 9}, {"correction": "كتبن", "end": 12, "event": "patch_accepted", "original": "كتب", "stage": "grammar", "start": 9}]}
{"sample_id": "G011", "dataset": "grammar", "input": "السيارة جميل جداً", "expected": "السيارة جميل جداً", "pipeline_output": "السيارة جميلة جداً", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 734, "punctuation_ms": 426, "spelling_ms": 1543, "total_ms": 2705}, "telemetry_events": [{"event": "grammar_raw_output", "input": "السيارة جميل جداً", "output": "السيارة جميلة جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جميلة جدا", "end": 17, "event": "grammar_diff", "original": "جميل جداً", "start": 8}, {"correction": "جميلة جداً", "end": 17, "event": "patch_accepted", "original": "جميل جداً", "stage": "grammar", "start": 8}]}
{"sample_id": "G012", "dataset": "grammar", "input": "البنت ذكي في المدرسة", "expected": "البنت ذكي في المدرسة", "pipeline_output": "البنت ذكية في المدرسة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 588, "punctuation_ms": 645, "spelling_ms": 1642, "total_ms": 2877}, "telemetry_events": [{"event": "grammar_raw_output", "input": "البنت ذكي في المدرسة", "output": "البنت ذكية في المدرسة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "ذكية", "end": 9, "event": "grammar_diff", "original": "ذكي", "start": 6}, {"correction": "ذكية", "end": 9, "event": "patch_accepted", "original": "ذكي", "stage": "grammar", "start": 6}]}
{"sample_id": "G013", "dataset": "grammar", "input": "الطالبة متفوق في دراسته", "expected": "الطالبة متفوق في دراسته", "pipeline_output": "الطالب متفوق في دراسته", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 642, "punctuation_ms": 402, "spelling_ms": 1768, "total_ms": 2815}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الطالبة متفوق في دراسته", "output": "الطالب متفوق في دراسته"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الطالب", "end": 7, "event": "grammar_diff", "original": "الطالبة", "start": 0}, {"correction": "الطالب", "end": 7, "event": "patch_accepted", "original": "الطالبة", "stage": "grammar", "start": 0}]}
{"sample_id": "G014", "dataset": "grammar", "input": "المدينة كبير وواسع", "expected": "المدينة كبير وواسع", "pipeline_output": "المدينة كبيرة وواسعة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 643, "punctuation_ms": 695, "spelling_ms": 1955, "total_ms": 3296}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المدينة كبير وواسع", "output": "المدينة كبيرة وواسعة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "كبيرة وواسعة", "end": 18, "event": "grammar_diff", "original": "كبير وواسع", "start": 8}, {"correction": "كبيرة وواسعة", "end": 18, "event": "patch_accepted", "original": "كبير وواسع", "stage": "grammar", "start": 8}]}
{"sample_id": "G015", "dataset": "grammar", "input": "الشمس مشرق اليوم", "expected": "الشمس مشرق اليوم", "pipeline_output": "الشمس مشرقة اليوم", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 531, "punctuation_ms": 448, "spelling_ms": 1398, "total_ms": 2380}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الشمس مشرق اليوم", "output": "الشمس مشرقة اليوم"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "مشرقة", "end": 10, "event": "grammar_diff", "original": "مشرق", "start": 6}, {"correction": "مشرقة", "end": 10, "event": "patch_accepted", "original": "مشرق", "stage": "grammar", "start": 6}]}
{"sample_id": "G016", "dataset": "grammar", "input": "في المهندسون الماهرون", "expected": "في المهندسون الماهرون", "pipeline_output": "في المهندسين الماه رون", "passed": false, "suggestion_count": 2, "timing": {"grammar_ms": 778, "punctuation_ms": 521, "spelling_ms": 1676, "total_ms": 2977}, "telemetry_events": [{"event": "grammar_raw_output", "input": "في المهندسون الماه رون", "output": "في المهندسين الماه رون"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المهندسين", "end": 12, "event": "grammar_diff", "original": "المهندسون", "start": 3}, {"correction": "المهندسين", "end": 12, "event": "patch_accepted", "original": "المهندسون", "stage": "grammar", "start": 3}]}
{"sample_id": "G017", "dataset": "grammar", "input": "من المعلمون الأكفاء", "expected": "من المعلمون الأكفاء", "pipeline_output": "من المعلمين الأكفاء", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 577, "punctuation_ms": 431, "spelling_ms": 1955, "total_ms": 2968}, "telemetry_events": [{"event": "grammar_raw_output", "input": "من المعلمون الأكفاء", "output": "من المعلمين الأكفاء"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المعلمين", "end": 11, "event": "grammar_diff", "original": "المعلمون", "start": 3}, {"correction": "المعلمين", "end": 11, "event": "patch_accepted", "original": "المعلمون", "stage": "grammar", "start": 3}]}
{"sample_id": "G018", "dataset": "grammar", "input": "إلى المسافرون في المطار", "expected": "إلى المسافرون في المطار", "pipeline_output": "إلى المسافرين في المطار", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 629, "punctuation_ms": 426, "spelling_ms": 3249, "total_ms": 4306}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إلى المسافرون في المطار", "output": "إلى المسافرين في المطار"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المسافرين", "end": 13, "event": "grammar_diff", "original": "المسافرون", "start": 4}, {"correction": "المسافرين", "end": 13, "event": "patch_accepted", "original": "المسافرون", "stage": "grammar", "start": 4}]}
{"sample_id": "G019", "dataset": "grammar", "input": "على العاملون في المصنع", "expected": "على العاملون في المصنع", "pipeline_output": "على العاملين في المصنع", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 537, "punctuation_ms": 501, "spelling_ms": 1644, "total_ms": 2683}, "telemetry_events": [{"event": "grammar_raw_output", "input": "على العاملون في المصنع", "output": "على العاملين في المصنع"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "العاملين", "end": 12, "event": "grammar_diff", "original": "العاملون", "start": 4}, {"correction": "العاملين", "end": 12, "event": "patch_accepted", "original": "العاملون", "stage": "grammar", "start": 4}]}
{"sample_id": "G020", "dataset": "grammar", "input": "عن المهندسون في الشركة", "expected": "عن المهندسون في الشركة", "pipeline_output": "عن المهندسين في الشركة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 578, "punctuation_ms": 552, "spelling_ms": 1588, "total_ms": 2720}, "telemetry_events": [{"event": "grammar_raw_output", "input": "عن المهندسون في الشركة", "output": "عن المهندسين في الشركة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المهندسين", "end": 12, "event": "grammar_diff", "original": "المهندسون", "start": 3}, {"correction": "المهندسين", "end": 12, "event": "patch_accepted", "original": "المهندسون", "stage": "grammar", "start": 3}]}
{"sample_id": "G021", "dataset": "grammar", "input": "إن أبوك رجل طيب جداً", "expected": "إن أبوك رجل طيب جداً", "pipeline_output": "إن أباك رجل طيب جداً", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 789, "punctuation_ms": 409, "spelling_ms": 3009, "total_ms": 4209}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إن أبوك رجل طيب جداً", "output": "إن أباك رجل طيب جدا"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "أباك", "end": 7, "event": "grammar_diff", "original": "أبوك", "start": 3}, {"correction": "أباك", "end": 7, "event": "patch_accepted", "original": "أبوك", "stage": "grammar", "start": 3}, {"correction": "جدا", "end": 20, "event": "grammar_diff", "original": "جداً", "start": 16}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]}
{"sample_id": "G022", "dataset": "grammar", "input": "رأيت أخوك في المسجد", "expected": "رأيت أخوك في المسجد", "pipeline_output": "رأيت أخوك في المسجد", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 629, "punctuation_ms": 527, "spelling_ms": 2347, "total_ms": 3504}, "telemetry_events": [{"event": "grammar_raw_output", "input": "رأيت أخوك في المسجد", "output": "رأيت أخوك في المسجد"}]}
{"sample_id": "G023", "dataset": "grammar", "input": "في أبوك خير كثير", "expected": "في أبوك خير كثير", "pipeline_output": "في أبيك خير كثير", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 534, "punctuation_ms": 322, "spelling_ms": 3046, "total_ms": 3904}, "telemetry_events": [{"event": "grammar_raw_output", "input": "في أبوك خير كثير", "output": "في أبيك خير كثير"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "أبيك", "end": 7, "event": "grammar_diff", "original": "أبوك", "start": 3}, {"correction": "أبيك", "end": 7, "event": "patch_accepted", "original": "أبوك", "stage": "grammar", "start": 3}]}
{"sample_id": "G024", "dataset": "grammar", "input": "على أخوك أن يحضر", "expected": "على أخوك أن يحضر", "pipeline_output": "على أخيك أن يحضر", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 538, "punctuation_ms": 344, "spelling_ms": 3880, "total_ms": 4765}, "telemetry_events": [{"event": "grammar_raw_output", "input": "على أخوك أن يحضر", "output": "على أخيك أن يحضر"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "أخيك", "end": 8, "event": "grammar_diff", "original": "أخوك", "start": 4}, {"correction": "أخيك", "end": 8, "event": "patch_accepted", "original": "أخوك", "stage": "grammar", "start": 4}]}
{"sample_id": "G025", "dataset": "grammar", "input": "هذان الطالبتان مجتهدتان", "expected": "هذان الطالبتان مجتهدتان", "pipeline_output": "هاتان الطالبتان مجتهدتان", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 674, "punctuation_ms": 436, "spelling_ms": 2766, "total_ms": 3879}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هذان الطالبتان مجتهدتان", "output": "هاتان الطالبتان مجتهدتان"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "هاتان", "end": 4, "event": "grammar_diff", "original": "هذان", "start": 0}, {"correction": "هاتان", "end": 4, "event": "patch_accepted", "original": "هذان", "stage": "grammar", "start": 0}]}
{"sample_id": "G026", "dataset": "grammar", "input": "هاتان الطالبان مجتهدان", "expected": "هاتان الطالبان مجتهدان", "pipeline_output": "هذان الطالبان مجتهدان", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 676, "punctuation_ms": 371, "spelling_ms": 2451, "total_ms": 3500}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هاتان الطالبان مجتهدان", "output": "هذان الطالبان مجتهدان"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "هذان", "end": 5, "event": "grammar_diff", "original": "هاتان", "start": 0}, {"correction": "هذان", "end": 5, "event": "patch_accepted", "original": "هاتان", "stage": "grammar", "start": 0}]}
{"sample_id": "G027", "dataset": "grammar", "input": "لن يذهبون إلى المدرسة", "expected": "لن يذهبون إلى المدرسة", "pipeline_output": "لن يذهبوا إلى المدرسة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 681, "punctuation_ms": 451, "spelling_ms": 1375, "total_ms": 2510}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لن يذهبون إلى المدرسة", "output": "لن يذهبوا إلى المدرسة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يذهبوا", "end": 9, "event": "grammar_diff", "original": "يذهبون", "start": 3}, {"correction": "يذهبوا", "end": 9, "event": "patch_accepted", "original": "يذهبون", "stage": "grammar", "start": 3}]}
{"sample_id": "G028", "dataset": "grammar", "input": "لم يفعلون الواجب بعد", "expected": "لم يفعلون الواجب بعد", "pipeline_output": "لم يفعلون الواجب بعد", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 683, "punctuation_ms": 419, "spelling_ms": 1482, "total_ms": 2586}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لم يفعلون الواجب بعد", "output": "لم يفعلوَ الواجب بعد"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يفعلوَ", "end": 9, "event": "grammar_diff", "original": "يفعلون", "start": 3}, {"correction": "يفعلوَ", "event": "filter_reject", "filter": "IVtoOOV", "original": "يفعلون"}]}
{"sample_id": "G029", "dataset": "grammar", "input": "كي يتعلمون الدرس", "expected": "كي يتعلمون الدرس", "pipeline_output": "كي يتعلم الدرس", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 428, "punctuation_ms": 345, "spelling_ms": 1211, "total_ms": 1987}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كي يتعلمون الدرس", "output": "كي يتعلم الدرس"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يتعلم", "end": 10, "event": "grammar_diff", "original": "يتعلمون", "start": 3}, {"correction": "يتعلم", "end": 10, "event": "patch_accepted", "original": "يتعلمون", "stage": "grammar", "start": 3}]}
{"sample_id": "G030", "dataset": "grammar", "input": "حتى يعملون بجد", "expected": "حتى يعملون بجد", "pipeline_output": "حتى يعملوا بجد", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 580, "punctuation_ms": 322, "spelling_ms": 1502, "total_ms": 2405}, "telemetry_events": [{"event": "grammar_raw_output", "input": "حتى يعملون بجد", "output": "حتى يعملوا بجد"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يعملوا", "end": 10, "event": "grammar_diff", "original": "يعملون", "start": 4}, {"correction": "يعملوا", "end": 10, "event": "patch_accepted", "original": "يعملون", "stage": "grammar", "start": 4}]}
{"sample_id": "G031", "dataset": "grammar", "input": "ذهب الطالب إلى المدرسة", "expected": "ذهب الطالب إلى المدرسة", "pipeline_output": "ذهب الطالب إلى المدرسة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 533, "punctuation_ms": 428, "spelling_ms": 1491, "total_ms": 2454}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهب الطالب إلى المدرسة", "output": "ذهب الطالب إلى المدرسة"}]}
{"sample_id": "G032", "dataset": "grammar", "input": "كتبت الطالبة المقال بنجاح", "expected": "كتبت الطالبة المقال بنجاح", "pipeline_output": "كتبت الطالبة المقال بنجاح", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 585, "punctuation_ms": 614, "spelling_ms": 1911, "total_ms": 3112}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كتبت الطالبة المقال بنجاح", "output": "كتبت الطالبة المقال بنجاح"}]}
{"sample_id": "G033", "dataset": "grammar", "input": "المعلمون في المدرسة يعملون", "expected": "المعلمون في المدرسة يعملون", "pipeline_output": "المعلمون في المدرسة يعملون", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 577, "punctuation_ms": 690, "spelling_ms": 1553, "total_ms": 2821}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المعلمون في المدرسة يعملون", "output": "المعلمون في المدرسة يعملون"}]}
{"sample_id": "G034", "dataset": "grammar", "input": "أحب القراءة والكتابة كثيراً", "expected": "أحب القراءة والكتابة كثيراً", "pipeline_output": "أحب القراءة والكتابة كثيراً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 590, "punctuation_ms": 553, "spelling_ms": 1777, "total_ms": 2922}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أحب القراءة والكتابة كثيراً", "output": "أحب القراءة والكتابة كثيرا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "كثيرا", "end": 27, "event": "grammar_diff", "original": "كثيراً", "start": 21}, {"correction": "كثيرا", "event": "filter_reject", "filter": "TanweenGuard", "original": "كثيراً"}]}
{"sample_id": "G035", "dataset": "grammar", "input": "ذهبت البنات إلى المدرسة", "expected": "ذهبت البنات إلى المدرسة", "pipeline_output": "ذهبت البنات إلى المدرسة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 531, "punctuation_ms": 510, "spelling_ms": 1703, "total_ms": 2746}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت البنات إلى المدرسة", "output": "ذهبت البنات إلى المدرسة"}]}
{"sample_id": "G036", "dataset": "grammar", "input": "جاء المعلمون إلى الفصل", "expected": "جاء المعلمون إلى الفصل", "pipeline_output": "جاء المعلمون إلى الفصل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 579, "punctuation_ms": 441, "spelling_ms": 1459, "total_ms": 2481}, "telemetry_events": [{"event": "grammar_raw_output", "input": "جاء المعلمون إلى الفصل", "output": "جاء المعلمون إلى الفصل"}]}
{"sample_id": "G037", "dataset": "grammar", "input": "ذهب الرجل إلى عمله", "expected": "ذهب الرجل إلى عمله", "pipeline_output": "ذهب الرجل إلى عمله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 691, "punctuation_ms": 398, "spelling_ms": 2269, "total_ms": 3359}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهب الرجل إلى عمله", "output": "ذهب الرجل إلى عمله"}]}
{"sample_id": "G038", "dataset": "grammar", "input": "يدرس الطالب في مكتبته", "expected": "يدرس الطالب في مكتبته", "pipeline_output": "يدرس الطالب في مكتبته", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 580, "punctuation_ms": 402, "spelling_ms": 2827, "total_ms": 3810}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يدرس الطالب في مكتبته", "output": "يدرس الطالب في مكتبته"}]}
{"sample_id": "G039", "dataset": "grammar", "input": "تعمل المرأة في الشركة", "expected": "تعمل المرأة في الشركة", "pipeline_output": "تعمل المرأة في الشركة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 531, "punctuation_ms": 410, "spelling_ms": 1482, "total_ms": 2424}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تعمل المرأة في الشركة", "output": "تعمل المرأة في الشركة"}]}
{"sample_id": "G040", "dataset": "grammar", "input": "نحن نجتهد في العمل", "expected": "نحن نجتهد في العمل", "pipeline_output": "نحن نجتهد في العمل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 680, "punctuation_ms": 370, "spelling_ms": 2591, "total_ms": 3643}, "telemetry_events": [{"event": "grammar_raw_output", "input": "نحن نجتهد في العمل", "output": "نحن نجتهد في العمل"}]}
{"sample_id": "G041", "dataset": "grammar", "input": "هم يسافرون كل صيف", "expected": "هم يسافرون كل صيف", "pipeline_output": "هم يسافرون كل صيف", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 732, "punctuation_ms": 365, "spelling_ms": 2181, "total_ms": 3280}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هم يسافرون كل صيف", "output": "هم يسافرون كل صيف"}]}
{"sample_id": "G042", "dataset": "grammar", "input": "الأطفال يلعبون في الحديقة", "expected": "الأطفال يلعبون في الحديقة", "pipeline_output": "الأطفال يلعبون في الحديقة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 631, "punctuation_ms": 508, "spelling_ms": 1308, "total_ms": 2449}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الأطفال يلعبون في الحديقة", "output": "الأطفال يلعبون في الحديقة"}]}
{"sample_id": "G043", "dataset": "grammar", "input": "إن العلم نافع للإنسان", "expected": "إن العلم نافع للإنسان", "pipeline_output": "إن العلم نافع للإنسين", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 481, "punctuation_ms": 481, "spelling_ms": 1458, "total_ms": 2421}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إن العلم نافع للإنسان", "output": "إن العلم نافع للإنسين"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "للإنسين", "end": 21, "event": "grammar_diff", "original": "للإنسان", "start": 14}, {"correction": "للإنسين", "end": 21, "event": "patch_accepted", "original": "للإنسان", "stage": "grammar", "start": 14}]}
{"sample_id": "G044", "dataset": "grammar", "input": "كان المطر غزيراً أمس", "expected": "كان المطر غزيراً أمس", "pipeline_output": "كان المطر غزيراً أمس", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 785, "punctuation_ms": 387, "spelling_ms": 2286, "total_ms": 3460}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كان المطر غزيراً أمس", "output": "كان المطر غزيرا أمس"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "غزيرا", "end": 16, "event": "grammar_diff", "original": "غزيراً", "start": 10}, {"correction": "غزيرا", "event": "filter_reject", "filter": "TanweenGuard", "original": "غزيراً"}]}
{"sample_id": "G045", "dataset": "grammar", "input": "لم يحضر الطالب اليوم", "expected": "لم يحضر الطالب اليوم", "pipeline_output": "لم يحضر الطالب اليوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 680, "punctuation_ms": 387, "spelling_ms": 1453, "total_ms": 2521}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لم يحضر الطالب اليوم", "output": "لم يحضر الطالب اليوم"}]}
{"sample_id": "H001", "dataset": "hallucination", "input": "أعلن رئيس الوزراء عن خطة اقتصادية جديدة لتطوير البنية التحتية في البلاد.", "expected": "أعلن رئيس الوزراء عن خطة اقتصادية جديدة لتطوير البنية التحتية في البلاد.", "pipeline_output": "أعلن رئيس الوزراء عن خطة اقتصادية جديدة لتطوير البنية التحتية في البلاد.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1262, "punctuation_ms": 1072, "spelling_ms": 8434, "total_ms": 10770}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أعلن رئيس الوزراء عن خطة اقتصادية جديدة لتطوير البنية التحتية في البلاد.", "output": "أعلن رئيس الوزراء عن خطة اقتصادية جديدة لتطوير البنية التحتية في البلاد"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "البلاد", "end": 72, "event": "grammar_diff", "original": "البلاد.", "start": 65}, {"correction": "البلاد", "event": "filter_reject", "filter": "PunctuationGuard", "original": "البلاد."}]}
{"sample_id": "H002", "dataset": "hallucination", "input": "شهدت المنطقة تطورات ميدانية متسارعة خلال الأيام الماضية.", "expected": "شهدت المنطقة تطورات ميدانية متسارعة خلال الأيام الماضية.", "pipeline_output": "شهدت المنطقة تطورات ميدانية متسارعة خلال الأيام الماضية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1049, "punctuation_ms": 812, "spelling_ms": 4726, "total_ms": 6588}, "telemetry_events": [{"event": "grammar_raw_output", "input": "شهدت المنطقة تطورات ميدانية متسارعة خلال الأيام الماضية.", "output": "شهدت المنطقة تطورات ميدانية متسارعة خلال الأيام الماضية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الماضية", "end": 56, "event": "grammar_diff", "original": "الماضية.", "start": 48}, {"correction": "الماضية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الماضية."}]}
{"sample_id": "H003", "dataset": "hallucination", "input": "أكد وزير التعليم أن المناهج الدراسية ستشهد تحديثاً شاملاً.", "expected": "أكد وزير التعليم أن المناهج الدراسية ستشهد تحديثاً شاملاً.", "pipeline_output": "أكد وزير التعليم أن المناهج الدراسية ستشهد تحديثاً شاملاً.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1190, "punctuation_ms": 891, "spelling_ms": 7238, "total_ms": 9322}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أكد وزير التعليم أن المناهج الدراسية ستشهد تحديثاً شاملاً.", "output": "أكد وزير التعليم أن المناهج الدراسية ستشهد تحديثا شاملا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "تحديثا شاملا", "end": 58, "event": "grammar_diff", "original": "تحديثاً شاملاً.", "start": 43}, {"correction": "تحديثا شاملا", "event": "filter_reject", "filter": "PunctuationGuard", "original": "تحديثاً شاملاً."}]}
{"sample_id": "H004", "dataset": "hallucination", "input": "افتتح الرئيس مشروعاً جديداً للطاقة المتجددة في الصحراء الغربية.", "expected": "افتتح الرئيس مشروعاً جديداً للطاقة المتجددة في الصحراء الغربية.", "pipeline_output": "افتتح الرئيس مشروعاً جديداً للطاقة المتجددة في الصحراء الغربية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1239, "punctuation_ms": 1055, "spelling_ms": 9349, "total_ms": 11645}, "telemetry_events": [{"event": "grammar_raw_output", "input": "افتتح الرئيس مشروعاً جديداً للطاقة المتجددة في الصحراء الغربية.", "output": "افتتح الرئيس مشروعا جديدا للطاقة المتجددة في الصحراء الغربية"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "مشروعا جديدا", "end": 27, "event": "grammar_diff", "original": "مشروعاً جديداً", "start": 13}, {"correction": "مشروعا جديدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "مشروعاً جديداً"}, {"correction": "الغربية", "end": 63, "event": "grammar_diff", "original": "الغربية.", "start": 55}, {"correction": "الغربية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الغربية."}]}
{"sample_id": "H005", "dataset": "hallucination", "input": "حققت الصادرات المصرية نمواً بنسبة عشرة بالمئة خلال الربع الأول.", "expected": "حققت الصادرات المصرية نمواً بنسبة عشرة بالمئة خلال الربع الأول.", "pipeline_output": "حققت الصادرات المصرية نمواً بنسبة عشرة بالمئة خلال الربع الأول.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1206, "punctuation_ms": 1192, "spelling_ms": 9829, "total_ms": 12229}, "telemetry_events": [{"event": "grammar_raw_output", "input": "حققت الصادرات المصرية نمواً بنسبة عشرة بالمئة خلال الربع الأول.", "output": "حققت الصادرات المصرية نموا بنسبة عشرة بالمئة خلال الربع الأول"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "نموا", "end": 27, "event": "grammar_diff", "original": "نمواً", "start": 22}, {"correction": "نموا", "event": "filter_reject", "filter": "TanweenGuard", "original": "نمواً"}, {"correction": "الأول", "end": 63, "event": "grammar_diff", "original": "الأول.", "start": 57}, {"correction": "الأول", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الأول."}]}
{"sample_id": "H006", "dataset": "hallucination", "input": "تهدف هذه الدراسة إلى تحليل العوامل المؤثرة في جودة التعليم العالي.", "expected": "تهدف هذه الدراسة إلى تحليل العوامل المؤثرة في جودة التعليم العالي.", "pipeline_output": "تهدف هذه الدراسة إلى تحليل العوامل المؤثرة في جودة التعليم العالي.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1098, "punctuation_ms": 1168, "spelling_ms": 11567, "total_ms": 13836}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تهدف هذه الدراسة إلى تحليل العوامل المؤثرة في جودة التعليم العالي.", "output": "تهدف هذه الدراسة إلى تحليل العوامل المؤثرة في جودة التعليم العالي"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "العالي", "end": 66, "event": "grammar_diff", "original": "العالي.", "start": 59}, {"correction": "العالي", "event": "filter_reject", "filter": "PunctuationGuard", "original": "العالي."}]}
{"sample_id": "H007", "dataset": "hallucination", "input": "أشارت النتائج إلى وجود علاقة إيجابية بين المتغيرين المدروسين.", "expected": "أشارت النتائج إلى وجود علاقة إيجابية بين المتغيرين المدروسين.", "pipeline_output": "أشارت النتائج إلى وجود علاقة إيجابية بين المتغيرين المدروسين.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1305, "punctuation_ms": 1092, "spelling_ms": 6654, "total_ms": 9053}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أشارت النتائج إلى وجود علاقة إيجابية بين المتغيرين المدروسين.", "output": "أشارت النتائج إلى وجود علاقة إيجابية بين المتغيرين المدروسين"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المدروسين", "end": 61, "event": "grammar_diff", "original": "المدروسين.", "start": 51}, {"correction": "المدروسين", "event": "filter_reject", "filter": "PunctuationGuard", "original": "المدروسين."}]}
{"sample_id": "H008", "dataset": "hallucination", "input": "استخدم الباحثون المنهج الوصفي التحليلي لدراسة الظاهرة.", "expected": "استخدم الباحثون المنهج الوصفي التحليلي لدراسة الظاهرة.", "pipeline_output": "استخدم الباحثون المنهج الوصفي التحليلي لدراسة الظاهرة.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1068, "punctuation_ms": 1040, "spelling_ms": 7694, "total_ms": 9804}, "telemetry_events": [{"event": "grammar_raw_output", "input": "استخدم الباحثون المنهج الوصفي التحليلي لدراسة الظاهرة.", "output": "استخدم الباحثون المنهج الوصفي التحليلي لدراسة الظاهرة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الظاهرة", "end": 54, "event": "grammar_diff", "original": "الظاهرة.", "start": 46}, {"correction": "الظاهرة", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الظاهرة."}]}
{"sample_id": "H009", "dataset": "hallucination", "input": "تم جمع البيانات من خلال استبانة إلكترونية وزعت على العينة.", "expected": "تم جمع البيانات من خلال استبانة إلكترونية وزعت على العينة.", "pipeline_output": "تم جمع البيانات من خلال استبانة إلكترونية وزعت على العينة.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1302, "punctuation_ms": 916, "spelling_ms": 13212, "total_ms": 15432}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تم جمع البيانات من خلال استبانة إلكترونية وزعت على العينة.", "output": "تم جمع البيانات من خلال استبانة إلكترونية وزعت على العينة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "العينة", "end": 58, "event": "grammar_diff", "original": "العينة.", "start": 51}, {"correction": "العينة", "event": "filter_reject", "filter": "PunctuationGuard", "original": "العينة."}]}
{"sample_id": "H010", "dataset": "hallucination", "input": "يوصي الباحث بإجراء دراسات مستقبلية لتعميق الفهم.", "expected": "يوصي الباحث بإجراء دراسات مستقبلية لتعميق الفهم.", "pipeline_output": "يوصي الباحث بإجراء دراسات مستقبلية لتعميق الفهم.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1163, "punctuation_ms": 806, "spelling_ms": 4678, "total_ms": 6650}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يوصي الباحث بإجراء دراسات مستقبلية لتعميق الفهم.", "output": "يوصي الباحث بإجراء دراسات مستقبلية لتعميق الفهم"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الفهم", "end": 48, "event": "grammar_diff", "original": "الفهم.", "start": 42}, {"correction": "الفهم", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الفهم."}]}
{"sample_id": "H011", "dataset": "hallucination", "input": "يعتمد النظام على بنية خادم عميل مع واجهة برمجة تطبيقات.", "expected": "يعتمد النظام على بنية خادم عميل مع واجهة برمجة تطبيقات.", "pipeline_output": "يعتمد النظام على بنية خادم عميل مع واجهة برمجة تطبيقات.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1081, "punctuation_ms": 1187, "spelling_ms": 10267, "total_ms": 12536}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يعتمد النظام على بنية خادم عميل مع واجهة برمجة تطبيقات.", "output": "يعتمد النظام على بنية خادم عميل مع واجهة برمجة تطبيقات"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "تطبيقات", "end": 55, "event": "grammar_diff", "original": "تطبيقات.", "start": 47}, {"correction": "تطبيقات", "event": "filter_reject", "filter": "PunctuationGuard", "original": "تطبيقات."}]}
{"sample_id": "H012", "dataset": "hallucination", "input": "تم تطوير التطبيق باستخدام إطار عمل حديث للواجهة الأمامية.", "expected": "تم تطوير التطبيق باستخدام إطار عمل حديث للواجهة الأمامية.", "pipeline_output": "تم تطوير التطبيق باستخدام إطار عمل حديث للواجهة الأمامية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1194, "punctuation_ms": 1082, "spelling_ms": 13192, "total_ms": 15470}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تم تطوير التطبيق باستخدام إطار عمل حديث للواجهة الأمامية.", "output": "تم تطوير التطبيق باستخدام إطار عمل حديث للواجهة الأمامية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الأمامية", "end": 57, "event": "grammar_diff", "original": "الأمامية.", "start": 48}, {"correction": "الأمامية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الأمامية."}]}
{"sample_id": "H013", "dataset": "hallucination", "input": "يستخدم النظام خوارزمية التعلم العميق لمعالجة اللغة الطبيعية.", "expected": "يستخدم النظام خوارزمية التعلم العميق لمعالجة اللغة الطبيعية.", "pipeline_output": "يستخدم النظام خوارزمية التعلم العميق لمعالجة اللغة الطبيعية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 994, "punctuation_ms": 924, "spelling_ms": 8400, "total_ms": 10319}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يستخدم النظام خوارزمية التعلم العميق لمعالجة اللغة الطبيعية.", "output": "يستخدم النظام خوارزمية التعلم العميق لمعالجة اللغة الطبيعية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الطبيعية", "end": 60, "event": "grammar_diff", "original": "الطبيعية.", "start": 51}, {"correction": "الطبيعية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الطبيعية."}]}
{"sample_id": "H014", "dataset": "hallucination", "input": "وفقاً للمادة الخامسة من القانون المدني يحق للمتضرر المطالبة بالتعويض.", "expected": "وفقاً للمادة الخامسة من القانون المدني يحق للمتضرر المطالبة بالتعويض.", "pipeline_output": "وفقاً للمادة الخامسة من القانين المدنيون يحق للمتضرر المطالبة بالتعويض.", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 1450, "punctuation_ms": 1285, "spelling_ms": 12348, "total_ms": 15086}, "telemetry_events": [{"event": "grammar_raw_output", "input": "وفقاً للمادة الخامسة من القانون المدني يحق للمتضرر المطالبة بالتعويض.", "output": "وفقا للمادة الخامسة من القانين المدنيون يحق للمتضرر المطالبة بالتعويض"}, {"count": 3, "event": "grammar_diffs_extracted"}, {"correction": "وفقا", "end": 5, "event": "grammar_diff", "original": "وفقاً", "start": 0}, {"correction": "وفقا", "event": "filter_reject", "filter": "TanweenGuard", "original": "وفقاً"}, {"correction": "القانين المدنيون", "end": 38, "event": "grammar_diff", "original": "القانون المدني", "start": 24}, {"correction": "القانين المدنيون", "end": 38, "event": "patch_accepted", "original": "القانون المدني", "stage": "grammar", "start": 24}, {"correction": "بالتعويض", "end": 69, "event": "grammar_diff", "original": "بالتعويض.", "start": 60}, {"correction": "بالتعويض", "event": "filter_reject", "filter": "PunctuationGuard", "original": "بالتعويض."}]}
{"sample_id": "H015", "dataset": "hallucination", "input": "يلتزم الطرف الأول بتسليم البضاعة خلال ثلاثين يوماً من تاريخ التعاقد.", "expected": "يلتزم الطرف الأول بتسليم البضاعة خلال ثلاثين يوماً من تاريخ التعاقد.", "pipeline_output": "يلتزم الطرف الأول بتسليم البضاعة خلال ثلاثين يوماً من تاريخ التعاقد.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1194, "punctuation_ms": 962, "spelling_ms": 8748, "total_ms": 10906}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يلتزم الطرف الأول بتسليم البضاعة خلال ثلاثين يوماً من تاريخ التعاقد.", "output": "يلتزم الطرف الأول بتسليم البضاعة خلال ثلاثين يوما من تاريخ التعاقد"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "يوما", "end": 50, "event": "grammar_diff", "original": "يوماً", "start": 45}, {"correction": "يوما", "event": "filter_reject", "filter": "TanweenGuard", "original": "يوماً"}, {"correction": "التعاقد", "end": 68, "event": "grammar_diff", "original": "التعاقد.", "start": 60}, {"correction": "التعاقد", "event": "filter_reject", "filter": "PunctuationGuard", "original": "التعاقد."}]}
{"sample_id": "H016", "dataset": "hallucination", "input": "كانت الشمس تغرب خلف الجبال وتلون السماء بألوان الذهب والأرجوان.", "expected": "كانت الشمس تغرب خلف الجبال وتلون السماء بألوان الذهب والأرجوان.", "pipeline_output": "كانت الشمس تغرب خلف الجبال وتلون السماء بألوان الذهب والأرجوان.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1262, "punctuation_ms": 1069, "spelling_ms": 8018, "total_ms": 10351}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كانت الشمس تغرب خلف الجبال وتلون السماء بألوان الذهب والأرجوان.", "output": "كانت الشمس تغرب خلف الجبال وتلون السماء بألوان الذهب والأرجوان"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "والأرجوان", "end": 63, "event": "grammar_diff", "original": "والأرجوان.", "start": 53}, {"correction": "والأرجوان", "event": "filter_reject", "filter": "PunctuationGuard", "original": "والأرجوان."}]}
{"sample_id": "H017", "dataset": "hallucination", "input": "في تلك الليلة الهادئة كان صوت الأمواج يعزف لحناً حزيناً.", "expected": "في تلك الليلة الهادئة كان صوت الأمواج يعزف لحناً حزيناً.", "pipeline_output": "في تلك الليلة الهادئة كان صوت الأمواج يعزفون لحنَ حزيناً", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 1396, "punctuation_ms": 925, "spelling_ms": 10271, "total_ms": 12599}, "telemetry_events": [{"event": "grammar_raw_output", "input": "في تلك الليلة الهادئة كان صوت الأمواج يعزف لحناً حزيناً.", "output": "في تلك الليلة الهادئة كان صوت الأمواج يعزفون لحنَ حزينا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يعزفون لحنَ حزينا", "end": 56, "event": "grammar_diff", "original": "يعزف لحناً حزيناً.", "start": 38}, {"correction": "يعزفون لحنَ حزيناً", "end": 56, "event": "patch_accepted", "original": "يعزف لحناً حزيناً.", "stage": "grammar", "start": 38}]}
{"sample_id": "H018", "dataset": "hallucination", "input": "مضى الزمن سريعاً ولم يبق من الذكريات إلا ما حفظته القلوب.", "expected": "مضى الزمن سريعاً ولم يبق من الذكريات إلا ما حفظته القلوب.", "pipeline_output": "مضى الزمن سريعاً ولم يبق من الذكريات إلا ما حفظته القلوب.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1352, "punctuation_ms": 905, "spelling_ms": 10251, "total_ms": 12509}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مضى الزمن سريعاً ولم يبق من الذكريات إلا ما حفظته القلوب.", "output": "مضى الزمن سريعا ولم يبق من الذكريات إلا ما حفظته القلوب"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "سريعا", "end": 16, "event": "grammar_diff", "original": "سريعاً", "start": 10}, {"correction": "سريعا", "event": "filter_reject", "filter": "TanweenGuard", "original": "سريعاً"}, {"correction": "القلوب", "end": 57, "event": "grammar_diff", "original": "القلوب.", "start": 50}, {"correction": "القلوب", "event": "filter_reject", "filter": "PunctuationGuard", "original": "القلوب."}]}
{"sample_id": "H019", "dataset": "hallucination", "input": "الطالب يدرس في المكتبة.", "expected": "الطالب يدرس في المكتبة.", "pipeline_output": "الطالب يدرس في المكتبة.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 679, "punctuation_ms": 448, "spelling_ms": 3704, "total_ms": 4832}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الطالب يدرس في المكتبة.", "output": "الطالب يدرس في المكتبة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المكتبة", "end": 23, "event": "grammar_diff", "original": "المكتبة.", "start": 15}, {"correction": "المكتبة", "event": "filter_reject", "filter": "PunctuationGuard", "original": "المكتبة."}]}
{"sample_id": "H020", "dataset": "hallucination", "input": "ذهبت إلى السوق واشتريت خبزاً.", "expected": "ذهبت إلى السوق واشتريت خبزاً.", "pipeline_output": "ذهبت إلى السوق واشتريت خبزاً.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1088, "punctuation_ms": 715, "spelling_ms": 4110, "total_ms": 5916}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى السوق واشتريت خبزاً.", "output": "ذهبت إلى السوق واشتريت خبزا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "خبزا", "end": 29, "event": "grammar_diff", "original": "خبزاً.", "start": 23}, {"correction": "خبزا", "event": "filter_reject", "filter": "PunctuationGuard", "original": "خبزاً."}]}
{"sample_id": "H021", "dataset": "hallucination", "input": "المعلم يشرح الدرس بوضوح.", "expected": "المعلم يشرح الدرس بوضوح.", "pipeline_output": "المعلم يشرح الدرس بوضوح.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 585, "punctuation_ms": 451, "spelling_ms": 3803, "total_ms": 4841}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المعلم يشرح الدرس بوضوح.", "output": "المعلم يشرح الدرس بوضوح"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "بوضوح", "end": 24, "event": "grammar_diff", "original": "بوضوح.", "start": 18}, {"correction": "بوضوح", "event": "filter_reject", "filter": "PunctuationGuard", "original": "بوضوح."}]}
{"sample_id": "H022", "dataset": "hallucination", "input": "نحن نحب بلادنا ونعمل من أجلها.", "expected": "نحن نحب بلادنا ونعمل من أجلها.", "pipeline_output": "نحن نحب بلادنا ونعمل من أجلها.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 688, "punctuation_ms": 561, "spelling_ms": 3447, "total_ms": 4697}, "telemetry_events": [{"event": "grammar_raw_output", "input": "نحن نحب بلادنا ونعمل من أجلها.", "output": "نحن نحب بلادنا ونعمل من أجلها"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "أجلها", "end": 30, "event": "grammar_diff", "original": "أجلها.", "start": 24}, {"correction": "أجلها", "event": "filter_reject", "filter": "PunctuationGuard", "original": "أجلها."}]}
{"sample_id": "H023", "dataset": "hallucination", "input": "القراءة تنمي العقل وتوسع المدارك.", "expected": "القراءة تنمي العقل وتوسع المدارك.", "pipeline_output": "القراءة تنمي العقل وتوسع المدارك.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 853, "punctuation_ms": 778, "spelling_ms": 3697, "total_ms": 5329}, "telemetry_events": [{"event": "grammar_raw_output", "input": "القراءة تنمي العقل وتوسع المدارك.", "output": "القراءة تنمي العقل وتوسع المدارك"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المدارك", "end": 33, "event": "grammar_diff", "original": "المدارك.", "start": 25}, {"correction": "المدارك", "event": "filter_reject", "filter": "PunctuationGuard", "original": "المدارك."}]}
{"sample_id": "H024", "dataset": "hallucination", "input": "الماء ضروري للحياة والصحة.", "expected": "الماء ضروري للحياة والصحة.", "pipeline_output": "الماء ضروري للحياة والصحة.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 488, "punctuation_ms": 643, "spelling_ms": 3309, "total_ms": 4441}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الماء ضروري للحياة والصحة.", "output": "الماء ضروري للحياة والصحة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "والصحة", "end": 26, "event": "grammar_diff", "original": "والصحة.", "start": 19}, {"correction": "والصحة", "event": "filter_reject", "filter": "PunctuationGuard", "original": "والصحة."}]}
{"sample_id": "H025", "dataset": "hallucination", "input": "يجب أن نحترم الكبير ونعطف على الصغير.", "expected": "يجب أن نحترم الكبير ونعطف على الصغير.", "pipeline_output": "يجب أن نحترم الكبير ونعطف على الصغير.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 939, "punctuation_ms": 677, "spelling_ms": 7072, "total_ms": 8689}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يجب أن نحترم الكبير ونعطف على الصغير.", "output": "يجب أن نحترم الكبير ونعطف على الصغير"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الصغير", "end": 37, "event": "grammar_diff", "original": "الصغير.", "start": 30}, {"correction": "الصغير", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الصغير."}]}
{"sample_id": "H026", "dataset": "hallucination", "input": "إن التعليم هو أساس تقدم الأمم، وبدونه لا يمكن تحقيق التنمية المستدامة.", "expected": "إن التعليم هو أساس تقدم الأمم، وبدونه لا يمكن تحقيق التنمية المستدامة.", "pipeline_output": "إن التعليم هو أساس تقدم الأمم، وبدونه لا يمكن تحقيق التنمية المستدامة.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1367, "punctuation_ms": 1137, "spelling_ms": 10122, "total_ms": 12628}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إن التعليم هو أساس تقدم الأمم، وبدونه لا يمكن تحقيق التنمية المستدامة.", "output": "إن التعليم هو أساس تقدم الأمم ، وبدونه لا يمكن تحقيق التنمية المستدامة"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "الأمم ،", "end": 30, "event": "grammar_diff", "original": "الأمم،", "start": 24}, {"correction": "المستدامة", "end": 70, "event": "grammar_diff", "original": "المستدامة.", "start": 60}, {"correction": "المستدامة", "event": "filter_reject", "filter": "PunctuationGuard", "original": "المستدامة."}]}
{"sample_id": "H027", "dataset": "hallucination", "input": "تسعى الحكومة إلى تطوير منظومة التعليم وتحسين جودة المخرجات التعليمية.", "expected": "تسعى الحكومة إلى تطوير منظومة التعليم وتحسين جودة المخرجات التعليمية.", "pipeline_output": "تسعى الحكومة إلى تطوير منظومة التعليم وتحسين جودة المخرجات التعليمية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1229, "punctuation_ms": 1234, "spelling_ms": 9201, "total_ms": 11666}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تسعى الحكومة إلى تطوير منظومة التعليم وتحسين جودة المخرجات التعليمية.", "output": "تسعى الحكومة إلى تطوير منظومة التعليم وتحسين جودة المخرجات التعليمية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "التعليمية", "end": 69, "event": "grammar_diff", "original": "التعليمية.", "start": 59}, {"correction": "التعليمية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "التعليمية."}]}
{"sample_id": "H028", "dataset": "hallucination", "input": "أثبتت الدراسات العلمية أن ممارسة الرياضة بانتظام تحسن الصحة النفسية والجسدية.", "expected": "أثبتت الدراسات العلمية أن ممارسة الرياضة بانتظام تحسن الصحة النفسية والجسدية.", "pipeline_output": "أثبتت الدراسات العلمية أن ممارسة الرياضة بانتظام تحسن الصحة النفسية والجسدية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1373, "punctuation_ms": 1619, "spelling_ms": 11623, "total_ms": 14617}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أثبتت الدراسات العلمية أن ممارسة الرياضة بانتظام تحسن الصحة النفسية والجسدية.", "output": "أثبتت الدراسات العلمية أن ممارسة الرياضة بانتظام تحسن الصحة النفسية والجسدية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "والجسدية", "end": 77, "event": "grammar_diff", "original": "والجسدية.", "start": 68}, {"correction": "والجسدية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "والجسدية."}]}
{"sample_id": "H029", "dataset": "hallucination", "input": "يعد الذكاء الاصطناعي من أهم التقنيات الحديثة التي ستغير مستقبل البشرية.", "expected": "يعد الذكاء الاصطناعي من أهم التقنيات الحديثة التي ستغير مستقبل البشرية.", "pipeline_output": "يعد الذكاء الاصطناعي من أهم التقنيات الحديثة التي ستغير مستقبل البشرية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1149, "punctuation_ms": 1147, "spelling_ms": 11771, "total_ms": 14069}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يعد الذكاء الاصطناعي من أهم التقنيات الحديثة التي ستغير مستقبل البشرية.", "output": "يعد الذكاء الاصطناعي من أهم التقنيات الحديثة التي ستغير مستقبل البشرية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "البشرية", "end": 71, "event": "grammar_diff", "original": "البشرية.", "start": 63}, {"correction": "البشرية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "البشرية."}]}
{"sample_id": "H030", "dataset": "hallucination", "input": "تلعب وسائل التواصل الاجتماعي دوراً مهماً في تشكيل الرأي العام المعاصر.", "expected": "تلعب وسائل التواصل الاجتماعي دوراً مهماً في تشكيل الرأي العام المعاصر.", "pipeline_output": "تلعب وسائل التواصل الاجتماعي دوراً مهماً في تشكيل الرأي العام المعاصر.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1467, "punctuation_ms": 1014, "spelling_ms": 12974, "total_ms": 15456}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تلعب وسائل التواصل الاجتماعي دوراً مهماً في تشكيل الرأي العام المعاصر.", "output": "تلعب وسائل التواصل الاجتماعي دورا مهما في تشكيل الرأي العام المعاصر"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "دورا مهما", "end": 40, "event": "grammar_diff", "original": "دوراً مهماً", "start": 29}, {"correction": "دورا مهما", "event": "filter_reject", "filter": "TanweenGuard", "original": "دوراً مهماً"}, {"correction": "المعاصر", "end": 70, "event": "grammar_diff", "original": "المعاصر.", "start": 62}, {"correction": "المعاصر", "event": "filter_reject", "filter": "PunctuationGuard", "original": "المعاصر."}]}
{"sample_id": "P001", "dataset": "punctuation", "input": "ذهبت إلى المدرسة ثم عدت إلى البيت", "expected": "ذهبت إلى المدرسة ثم عدت إلى البيت", "pipeline_output": "ذهبت إلى المدرسة ثم عدت إلى البيت", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 743, "punctuation_ms": 980, "spelling_ms": 3270, "total_ms": 4995}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى المدرسة ثم عدت إلى البيت", "output": "ذهبت إلى المدرسة ثم عدت إلى البيت"}]}
{"sample_id": "P002", "dataset": "punctuation", "input": "هل أنت بخير يا صديقي", "expected": "هل أنت بخير يا صديقي", "pipeline_output": "هل أنت بخير يا صديقي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 684, "punctuation_ms": 449, "spelling_ms": 3266, "total_ms": 4401}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هل أنت بخير يا صديقي", "output": "هل أنت بخير يا صديقي"}]}
{"sample_id": "P003", "dataset": "punctuation", "input": "مرحبا كيف حالك اليوم", "expected": "مرحبا كيف حالك اليوم", "pipeline_output": "مرحبا كيف حالك اليوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 732, "punctuation_ms": 425, "spelling_ms": 3192, "total_ms": 4352}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مرحبا كيف حالك اليوم", "output": "مرحبا كيف حالك اليوم"}]}
{"sample_id": "P004", "dataset": "punctuation", "input": "كيف حالك أنا بخير والحمد لله", "expected": "كيف حالك أنا بخير والحمد لله", "pipeline_output": "كيف حالك أنا بخير والحمد لله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "P005", "dataset": "punctuation", "input": "هذا الكتاب مفيد جداً وأنصح بقراءته", "expected": "هذا الكتاب مفيد جداً وأنصح بقراءته", "pipeline_output": "هذا الكتاب مفيد جداً وأنصح بقراءته", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1041, "punctuation_ms": 600, "spelling_ms": 4316, "total_ms": 5960}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هذا الكتاب مفيد جداً وأنصح بقراءته", "output": "هذا الكتاب مفيد جدا وأنصح بقراءته"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 20, "event": "grammar_diff", "original": "جداً", "start": 16}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]}
{"sample_id": "P006", "dataset": "punctuation", "input": "العلم نور والجهل ظلام والتعليم مهم", "expected": "العلم نور والجهل ظلام والتعليم مهم", "pipeline_output": "العلم نور والجهل ظلام والتعليم مهم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 805, "punctuation_ms": 743, "spelling_ms": 3324, "total_ms": 4874}, "telemetry_events": [{"event": "grammar_raw_output", "input": "العلم نور والجهل ظلام والتعليم مهم", "output": "العلم نور والجهل ظلام والتعليم مهم"}]}
{"sample_id": "P007", "dataset": "punctuation", "input": "ماذا تريد أن تفعل اليوم", "expected": "ماذا تريد أن تفعل اليوم", "pipeline_output": "ماذا تريد أن تفعل اليوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 733, "punctuation_ms": 387, "spelling_ms": 2219, "total_ms": 3340}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ماذا تريد أن تفعل اليوم", "output": "ماذا تريد أن تفعل اليوم"}]}
{"sample_id": "P008", "dataset": "punctuation", "input": "لماذا لم تحضر أمس", "expected": "لماذا لم تحضر أمس", "pipeline_output": "لماذا لم تحضر أمس", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 582, "punctuation_ms": 318, "spelling_ms": 2269, "total_ms": 3171}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لماذا لم تحضر أمس", "output": "لماذا لم تحضر أمس"}]}
{"sample_id": "P009", "dataset": "punctuation", "input": "جاء أحمد ومحمد وعلي", "expected": "جاء أحمد ومحمد وعلي", "pipeline_output": "جاء أحمد ومحمد وعلي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 532, "punctuation_ms": 535, "spelling_ms": 2018, "total_ms": 3087}, "telemetry_events": [{"event": "grammar_raw_output", "input": "جاء أحمد ومحمد وعلي", "output": "جاء أحمد ومحمد وعلي"}]}
{"sample_id": "P010", "dataset": "punctuation", "input": "ذهبت إلى السوق واشتريت خبزاً ولحماً ثم عدت", "expected": "ذهبت إلى السوق واشتريت خبزاً ولحماً ثم عدت", "pipeline_output": "ذهبت إلى السوق واشتريت خبزاً ولحماً ثم عدت", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1347, "punctuation_ms": 880, "spelling_ms": 6120, "total_ms": 8350}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى السوق واشتريت خبزاً ولحماً ثم عدت", "output": "ذهبت إلى السوق واشتريت خبزا ولحما ثم عدت"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "خبزا ولحما", "end": 35, "event": "grammar_diff", "original": "خبزاً ولحماً", "start": 23}, {"correction": "خبزا ولحما", "event": "filter_reject", "filter": "TanweenGuard", "original": "خبزاً ولحماً"}]}
{"sample_id": "P011", "dataset": "punctuation", "input": "ذهبت إلى المدرسة. ثم عدت.", "expected": "ذهبت إلى المدرسة. ثم عدت.", "pipeline_output": "ذهبت إلى المدرسة ، ثم عدت.", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 735, "punctuation_ms": 590, "spelling_ms": 6655, "total_ms": 7982}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى المدرسة. ثم عدت.", "output": "ذهبت إلى المدرسة ، ثم عدت"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "المدرسة ،", "end": 17, "event": "grammar_diff", "original": "المدرسة.", "start": 9}, {"correction": "المدرسة ،", "end": 17, "event": "patch_accepted", "original": "المدرسة.", "stage": "grammar", "start": 9}, {"correction": "عدت", "end": 25, "event": "grammar_diff", "original": "عدت.", "start": 21}, {"correction": "عدت", "event": "filter_reject", "filter": "PunctuationGuard", "original": "عدت."}]}
{"sample_id": "P012", "dataset": "punctuation", "input": "كيف حالك؟ أنا بخير.", "expected": "كيف حالك؟ أنا بخير.", "pipeline_output": "كيف حالك؟ أنا بخير.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 735, "punctuation_ms": 415, "spelling_ms": 3752, "total_ms": 4904}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كيف حالك؟ أنا بخير.", "output": "كيف حالك ؟ أنا بخير"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "حالك ؟", "end": 9, "event": "grammar_diff", "original": "حالك؟", "start": 4}, {"correction": "بخير", "end": 19, "event": "grammar_diff", "original": "بخير.", "start": 14}, {"correction": "بخير", "event": "filter_reject", "filter": "PunctuationGuard", "original": "بخير."}]}
{"sample_id": "P013", "dataset": "punctuation", "input": "أحمد، كيف حالك؟ هل أنت بخير؟", "expected": "أحمد، كيف حالك؟ هل أنت بخير؟", "pipeline_output": "أحمد، كيف حالك؟ هل أنت بخير؟", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1031, "punctuation_ms": 535, "spelling_ms": 6899, "total_ms": 8467}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أحمد، كيف حالك؟ هل أنت بخير؟", "output": "أحمد ، كيف حالك ؟ هل أنت بخير ؟"}, {"count": 3, "event": "grammar_diffs_extracted"}, {"correction": "أحمد ،", "end": 5, "event": "grammar_diff", "original": "أحمد،", "start": 0}, {"correction": "حالك ؟", "end": 15, "event": "grammar_diff", "original": "حالك؟", "start": 10}, {"correction": "بخير ؟", "end": 28, "event": "grammar_diff", "original": "بخير؟", "start": 23}]}
{"sample_id": "P014", "dataset": "punctuation", "input": "قال: أنا بخير، شكراً لك.", "expected": "قال: أنا بخير، شكراً لك.", "pipeline_output": "قال: أنا بخير ، شكرا لكً", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 891, "punctuation_ms": 534, "spelling_ms": 5018, "total_ms": 6446}, "telemetry_events": [{"event": "grammar_raw_output", "input": "قال: أنا بخير، شكراً لك.", "output": "قال : أنا بخير ، شكرا لك"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "قال :", "end": 4, "event": "grammar_diff", "original": "قال:", "start": 0}, {"correction": "بخير ، شكرا لك", "end": 24, "event": "grammar_diff", "original": "بخير، شكراً لك.", "start": 9}, {"correction": "بخير ، شكرا لكً", "end": 24, "event": "patch_accepted", "original": "بخير، شكراً لك.", "stage": "grammar", "start": 9}]}
{"sample_id": "P015", "dataset": "punctuation", "input": "ذهبت إلى المكتبة، واشتريت كتاباً.", "expected": "ذهبت إلى المكتبة، واشتريت كتاباً.", "pipeline_output": "ذهبت إلى المكتبة، واشتريت كتاباً.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 988, "punctuation_ms": 731, "spelling_ms": 5682, "total_ms": 7402}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى المكتبة، واشتريت كتاباً.", "output": "ذهبت إلى المكتبة ، واشتريت كتابا"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "المكتبة ،", "end": 17, "event": "grammar_diff", "original": "المكتبة،", "start": 9}, {"correction": "كتابا", "end": 33, "event": "grammar_diff", "original": "كتاباً.", "start": 26}, {"correction": "كتابا", "event": "filter_reject", "filter": "PunctuationGuard", "original": "كتاباً."}]}
{"sample_id": "P016", "dataset": "punctuation", "input": "ذهبت الي المدرسه أمس", "expected": "ذهبت الي المدرسه أمس", "pipeline_output": "ذهبت إلى المدرسة أمس", "passed": false, "suggestion_count": 2, "timing": {"grammar_ms": 744, "punctuation_ms": 468, "spelling_ms": 2455, "total_ms": 3670}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى المدرسة أمس", "output": "ذهبت إلى المدرسة أمس"}]}
{"sample_id": "P017", "dataset": "punctuation", "input": "انا طالب في الجامعه", "expected": "انا طالب في الجامعه", "pipeline_output": "أنا طالب في الجامعة", "passed": false, "suggestion_count": 2, "timing": {"grammar_ms": 587, "punctuation_ms": 415, "spelling_ms": 4132, "total_ms": 5136}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أنا طالب في الجامعة", "output": "أنا طالب في الجامعة"}]}
{"sample_id": "P018", "dataset": "punctuation", "input": "قال أحمد أنا سعيد بلقائك يا صديقي", "expected": "قال أحمد أنا سعيد بلقائك يا صديقي", "pipeline_output": "قال أحمد أنا سعيد بلقائك يا صديقي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 785, "punctuation_ms": 640, "spelling_ms": 4525, "total_ms": 5952}, "telemetry_events": [{"event": "grammar_raw_output", "input": "قال أحمد أنا سعيد بلقائك يا صديقي", "output": "قال أحمد أنا سعيد بلقائك يا صديقي"}]}
{"sample_id": "P019", "dataset": "punctuation", "input": "أحتاج إلى خبز ولبن وجبن وبيض", "expected": "أحتاج إلى خبز ولبن وجبن وبيض", "pipeline_output": "أحتاج إلى خبز ولبن وجبن وبيض", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 995, "punctuation_ms": 628, "spelling_ms": 4203, "total_ms": 5828}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أحتاج إلى خبز ولبن وجبن وبيض", "output": "أحتاج إلى خبز ولبن وجبن وبيض"}]}
{"sample_id": "P020", "dataset": "punctuation", "input": "يا إلهي هذا رائع جداً", "expected": "يا إلهي هذا رائع جداً", "pipeline_output": "يا إلهي هذا رائع جداً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 684, "punctuation_ms": 538, "spelling_ms": 3014, "total_ms": 4238}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يا إلهي هذا رائع جداً", "output": "يا إلهي هذا رائع جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 21, "event": "grammar_diff", "original": "جداً", "start": 17}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]}
{"sample_id": "R001", "dataset": "religious", "input": "بسم الله الرحمن الرحيم", "expected": "بسم الله الرحمن الرحيم", "pipeline_output": "بسم الله الرحمن الرحيم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R002", "dataset": "religious", "input": "الحمد لله رب العالمين الرحمن الرحيم مالك يوم الدين", "expected": "الحمد لله رب العالمين الرحمن الرحيم مالك يوم الدين", "pipeline_output": "الحمد لله رب العالمين الرحمن الرحيم مالك يوم الدين", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R003", "dataset": "religious", "input": "إياك نعبد وإياك نستعين", "expected": "إياك نعبد وإياك نستعين", "pipeline_output": "إياك نعبد وإياك نستعين", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R004", "dataset": "religious", "input": "اهدنا الصراط المستقيم صراط الذين أنعمت عليهم", "expected": "اهدنا الصراط المستقيم صراط الذين أنعمت عليهم", "pipeline_output": "اهدنا الصراط المستقيم صراط الذين أنعمت عليهم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R005", "dataset": "religious", "input": "قل هو الله أحد الله الصمد لم يلد ولم يولد", "expected": "قل هو الله أحد الله الصمد لم يلد ولم يولد", "pipeline_output": "قل هو الله أحد الله الصمد لم يلد ولم يولد", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R006", "dataset": "religious", "input": "إنا أنزلناه في ليلة القدر", "expected": "إنا أنزلناه في ليلة القدر", "pipeline_output": "إنا أنزلناه في ليلة القدر", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R007", "dataset": "religious", "input": "قل أعوذ برب الفلق من شر ما خلق", "expected": "قل أعوذ برب الفلق من شر ما خلق", "pipeline_output": "قل أعوذ برب الفلق من شر ما خلق", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R008", "dataset": "religious", "input": "قل أعوذ برب الناس ملك الناس إله الناس", "expected": "قل أعوذ برب الناس ملك الناس إله الناس", "pipeline_output": "قل أعوذ برب الناس ملك الناس إله الناس", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R009", "dataset": "religious", "input": "ذلك الكتاب لا ريب فيه هدى للمتقين", "expected": "ذلك الكتاب لا ريب فيه هدى للمتقين", "pipeline_output": "ذلك الكتاب لا ريب فيه هدى للمتقين", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R010", "dataset": "religious", "input": "الذين يؤمنون بالغيب ويقيمون الصلاة", "expected": "الذين يؤمنون بالغيب ويقيمون الصلاة", "pipeline_output": "الذين يؤمنون بالغيب ويقيمون الصلاة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 732, "punctuation_ms": 666, "spelling_ms": 2581, "total_ms": 3980}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الذين يؤمنون بالغيب ويقيمون الصلاة", "output": "الذين يؤمنون بالغيب ويقيمون الصلاة"}]}
{"sample_id": "R011", "dataset": "religious", "input": "الله لا إله إلا هو الحي القيوم لا تأخذه سنة ولا نوم", "expected": "الله لا إله إلا هو الحي القيوم لا تأخذه سنة ولا نوم", "pipeline_output": "الله لا إله إلا هو الحي القيوم لا تأخذه سنة ولا نوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R012", "dataset": "religious", "input": "لا إله إلا الله محمد رسول الله", "expected": "لا إله إلا الله محمد رسول الله", "pipeline_output": "لا إله إلا الله محمد رسول الله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R013", "dataset": "religious", "input": "أشهد أن لا إله إلا الله وأشهد أن محمداً رسول الله", "expected": "أشهد أن لا إله إلا الله وأشهد أن محمداً رسول الله", "pipeline_output": "أشهد أن لا إله إلا الله وأشهد أن محمداً رسول الله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R014", "dataset": "religious", "input": "إنما الأعمال بالنيات وإنما لكل امرئ ما نوى", "expected": "إنما الأعمال بالنيات وإنما لكل امرئ ما نوى", "pipeline_output": "إنما الأعمال بالنيات وإنما لكل امرئ ما نوى", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R015", "dataset": "religious", "input": "خيركم من تعلم القرآن وعلمه", "expected": "خيركم من تعلم القرآن وعلمه", "pipeline_output": "خيركم من تعلم القرآن وعلمه", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 758, "punctuation_ms": 644, "spelling_ms": 3048, "total_ms": 4452}, "telemetry_events": [{"event": "grammar_raw_output", "input": "خيركم من تعلم القرآن وعلمه", "output": "خيركم من تعلم القرآن وعلمه"}]}
{"sample_id": "R016", "dataset": "religious", "input": "المسلم من سلم المسلمون من لسانه ويده", "expected": "المسلم من سلم المسلمون من لسانه ويده", "pipeline_output": "المسلم من سلم المسلمون من لسانه ويده", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R017", "dataset": "religious", "input": "لا يؤمن أحدكم حتى يحب لأخيه ما يحب لنفسه", "expected": "لا يؤمن أحدكم حتى يحب لأخيه ما يحب لنفسه", "pipeline_output": "لا يؤمن أحدكم حتى يحب لأخيه ما يحب لنفسه", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R018", "dataset": "religious", "input": "من كان يؤمن بالله واليوم الآخر فليقل خيراً أو ليصمت", "expected": "من كان يؤمن بالله واليوم الآخر فليقل خيراً أو ليصمت", "pipeline_output": "من كان يؤمن بالله واليوم الآخر فليقل خيراً أو ليصمت", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1163, "punctuation_ms": 1018, "spelling_ms": 8788, "total_ms": 10971}, "telemetry_events": [{"event": "grammar_raw_output", "input": "من كان يؤمن بالله واليوم الآخر فليقل خيراً أو ليصمت", "output": "من كان يؤمن بالله واليوم الآخر فليقل خيرا أو ليصمت"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "خيرا", "end": 42, "event": "grammar_diff", "original": "خيراً", "start": 37}, {"correction": "خيرا", "event": "filter_reject", "filter": "TanweenGuard", "original": "خيراً"}]}
{"sample_id": "R019", "dataset": "religious", "input": "ربنا آتنا في الدنيا حسنة وفي الآخرة حسنة وقنا عذاب النار", "expected": "ربنا آتنا في الدنيا حسنة وفي الآخرة حسنة وقنا عذاب النار", "pipeline_output": "ربنا آتنا في الدنيا حسنة وفي الآخرة حسنة وقنا عذاب النار", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R020", "dataset": "religious", "input": "رب اشرح لي صدري ويسر لي أمري", "expected": "رب اشرح لي صدري ويسر لي أمري", "pipeline_output": "رب اشرح لي صدري ويسر لي أمري", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R021", "dataset": "religious", "input": "حسبنا الله ونعم الوكيل", "expected": "حسبنا الله ونعم الوكيل", "pipeline_output": "حسبنا الله ونعم الوكيل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R022", "dataset": "religious", "input": "لا حول ولا قوة إلا بالله", "expected": "لا حول ولا قوة إلا بالله", "pipeline_output": "لا حول ولا قوة إلا بالله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R023", "dataset": "religious", "input": "الحمد لله رب العالمين", "expected": "الحمد لله رب العالمين", "pipeline_output": "الحمد لله رب العالمين", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R024", "dataset": "religious", "input": "سبحان الله وبحمده سبحان الله العظيم", "expected": "سبحان الله وبحمده سبحان الله العظيم", "pipeline_output": "سبحان الله وبحمده سبحان الله العظيم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R025", "dataset": "religious", "input": "اللهم صل وسلم على نبينا محمد", "expected": "اللهم صل وسلم على نبينا محمد", "pipeline_output": "اللهم صل وسلم على نبينا محمد", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R026", "dataset": "religious", "input": "أستغفر الله العظيم وأتوب إليه", "expected": "أستغفر الله العظيم وأتوب إليه", "pipeline_output": "أستغفر الله العظيم وأتوب إليه", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R027", "dataset": "religious", "input": "الله أكبر الله أكبر لا إله إلا الله", "expected": "الله أكبر الله أكبر لا إله إلا الله", "pipeline_output": "الله أكبر الله أكبر لا إله إلا الله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R028", "dataset": "religious", "input": "إنا لله وإنا إليه راجعون", "expected": "إنا لله وإنا إليه راجعون", "pipeline_output": "إنا لله وإنا إليه راجعون", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R029", "dataset": "religious", "input": "بسم الله والحمد لله", "expected": "بسم الله والحمد لله", "pipeline_output": "بسم الله والحمد لله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "R030", "dataset": "religious", "input": "السلام عليكم ورحمة الله وبركاته", "expected": "السلام عليكم ورحمة الله وبركاته", "pipeline_output": "السلام عليكم ورحمة الله وبركاته", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []}
{"sample_id": "S001", "dataset": "spelling", "input": "انا طالب في الجامعة", "expected": "أنا طالب في الجامعة", "pipeline_output": "أنا طالب في الجامعة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 642, "punctuation_ms": 331, "spelling_ms": 1535, "total_ms": 2510}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أنا طالب في الجامعة", "output": "أنا طالب في الجامعة"}]}
{"sample_id": "S002", "dataset": "spelling", "input": "اذا جاء الربيع تزهر الأشجار", "expected": "إذا جاء الربيع تزهر الأشجار", "pipeline_output": "إذا جاء الربيع تزهر الأشجار", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 634, "punctuation_ms": 532, "spelling_ms": 3389, "total_ms": 4557}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إذا جاء الربيع تزهر الأشجار", "output": "إذا جاء الربيع تزهر الأشجار"}]}
{"sample_id": "S003", "dataset": "spelling", "input": "ايضا هذا الأمر مهم جداً", "expected": "أيضاً هذا الأمر مهم جداً", "pipeline_output": "ايضا هذا الأمر مهم جداً", "passed": false, "suggestion_count": 0, "timing": {"grammar_ms": 687, "punctuation_ms": 614, "spelling_ms": 3166, "total_ms": 4469}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ايضا هذا الأمر مهم جداً", "output": "ايضا هذا الأمر مهم جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 23, "event": "grammar_diff", "original": "جداً", "start": 19}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]}
{"sample_id": "S004", "dataset": "spelling", "input": "لان الأمر يتعلق بالمستقبل", "expected": "لأن الأمر يتعلق بالمستقبل", "pipeline_output": "لأن الأمر يتعلق بالمستقبل", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 533, "punctuation_ms": 517, "spelling_ms": 2949, "total_ms": 4002}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لأن الأمر يتعلق بالمستقبل", "output": "لأن الأمر يتعلق بالمستقبل"}]}
{"sample_id": "S005", "dataset": "spelling", "input": "اين ذهبت أمس", "expected": "أين ذهبت أمس", "pipeline_output": "أين ذهبت أمس", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 434, "punctuation_ms": 326, "spelling_ms": 1590, "total_ms": 2351}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أين ذهبت أمس", "output": "أين ذهبت أمس"}]}
{"sample_id": "S006", "dataset": "spelling", "input": "اول مرة أزور هذا المكان", "expected": "أول مرة أزور هذا المكان", "pipeline_output": "اول مرة أزور هذا المكان", "passed": false, "suggestion_count": 0, "timing": {"grammar_ms": 696, "punctuation_ms": 484, "spelling_ms": 3153, "total_ms": 4336}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اول مرة أزور هذا المكان", "output": "اول مرة أزور هذا المكان"}]}
{"sample_id": "S007", "dataset": "spelling", "input": "هذا او ذاك لا فرق", "expected": "هذا أو ذاك لا فرق", "pipeline_output": "هذا أو ذاك لا فرق", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 783, "punctuation_ms": 414, "spelling_ms": 3096, "total_ms": 4295}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هذا أو ذاك لا فرق", "output": "هذا أو ذاك لا فرق"}]}
{"sample_id": "S008", "dataset": "spelling", "input": "اكبر مدينة في العالم", "expected": "أكبر مدينة في العالم", "pipeline_output": "أكبر مدينة في العالم", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 541, "punctuation_ms": 377, "spelling_ms": 1859, "total_ms": 2780}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أكبر مدينة في العالم", "output": "أكبر مدينة في العالم"}]}
{"sample_id": "S009", "dataset": "spelling", "input": "اصغر طالب في الصف", "expected": "أصغر طالب في الصف", "pipeline_output": "أصغر طالب في الصف", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 587, "punctuation_ms": 432, "spelling_ms": 1807, "total_ms": 2827}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أصغر طالب في الصف", "output": "أصغر طالب في الصف"}]}
{"sample_id": "S010", "dataset": "spelling", "input": "ابناء الوطن يعملون بجد", "expected": "أبناء الوطن يعملون بجد", "pipeline_output": "أبناء الوطن يعملون بجد", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 631, "punctuation_ms": 420, "spelling_ms": 1563, "total_ms": 2617}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أبناء الوطن يعملون بجد", "output": "أبناء الوطن يعملون بجد"}]}
{"sample_id": "S011", "dataset": "spelling", "input": "اطفال المدرسة يلعبون", "expected": "أطفال المدرسة يلعبون", "pipeline_output": "أطفال المدرسة يلعبون", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 528, "punctuation_ms": 379, "spelling_ms": 1593, "total_ms": 2503}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أطفال المدرسة يلعبون", "output": "أطفال المدرسة يلعبون"}]}
{"sample_id": "S012", "dataset": "spelling", "input": "اخيراً وصلنا إلى الهدف", "expected": "أخيراً وصلنا إلى الهدف", "pipeline_output": "أخيراً وصلنا إلى الهدف", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 592, "punctuation_ms": 561, "spelling_ms": 3304, "total_ms": 4460}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اخيراً وصلنا إلى الهدف", "output": "أخيرا وصلنا إلى الهدف"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "أخيرا", "end": 6, "event": "grammar_diff", "original": "اخيراً", "start": 0}, {"correction": "أخيراً", "end": 6, "event": "patch_accepted", "original": "اخيراً", "stage": "spelling", "start": 0}]}
{"sample_id": "S013", "dataset": "spelling", "input": "وقف امام المدرسة", "expected": "وقف أمام المدرسة", "pipeline_output": "وقف أمام المدرسة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 448, "punctuation_ms": 364, "spelling_ms": 1410, "total_ms": 2225}, "telemetry_events": [{"event": "grammar_raw_output", "input": "وقف أمام المدرسة", "output": "وقف أمام المدرسة"}]}
{"sample_id": "S014", "dataset": "spelling", "input": "انت طالب مجتهد", "expected": "أنت طالب مجتهد", "pipeline_output": "أنت طالب مجتهد", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 533, "punctuation_ms": 276, "spelling_ms": 1525, "total_ms": 2336}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أنت طالب مجتهد", "output": "أنت طالب مجتهد"}]}
{"sample_id": "S015", "dataset": "spelling", "input": "اننا نحب الوطن", "expected": "إننا نحب الوطن", "pipeline_output": "اننا نحب الوطن", "passed": false, "suggestion_count": 0, "timing": {"grammar_ms": 480, "punctuation_ms": 398, "spelling_ms": 2145, "total_ms": 3025}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اننا نحب الوطن", "output": "اننا نحب الوطن"}]}
{"sample_id": "S016", "dataset": "spelling", "input": "ان شاء الله سنفوز", "expected": "إن شاء الله سنفوز", "pipeline_output": "إن شاء الله سنفوز", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 578, "punctuation_ms": 442, "spelling_ms": 2892, "total_ms": 3915}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ان شاء الله سنفوز", "output": "إن شاء الله سنفوز"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "إن", "end": 2, "event": "grammar_diff", "original": "ان", "start": 0}, {"correction": "إن", "end": 2, "event": "patch_accepted", "original": "ان", "stage": "spelling", "start": 0}]}
{"sample_id": "S017", "dataset": "spelling", "input": "اقترب الموعد النهائي", "expected": "اقترب الموعد النهائي", "pipeline_output": "اقترب الموعد النهائي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 532, "punctuation_ms": 396, "spelling_ms": 1503, "total_ms": 2433}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اقترب الموعد النهائي", "output": "اقترب الموعد النهائي"}]}
{"sample_id": "S018", "dataset": "spelling", "input": "ارسل الرسالة فوراً", "expected": "أرسل الرسالة فوراً", "pipeline_output": "أرسل الرسالة فوراً", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 583, "punctuation_ms": 387, "spelling_ms": 1583, "total_ms": 2555}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أرسل الرسالة فوراً", "output": "أرسلت الرسالة فورو"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "أرسلت", "end": 4, "event": "grammar_diff", "original": "أرسل", "start": 0}, {"correction": "أرسلت", "event": "filter_reject", "filter": "StageLocker", "original": "أرسل"}, {"correction": "فورو", "end": 18, "event": "grammar_diff", "original": "فوراً", "start": 13}, {"correction": "فورو", "event": "filter_reject", "filter": "IVtoOOV", "original": "فوراً"}]}
{"sample_id": "S019", "dataset": "spelling", "input": "اخر الأخبار في المساء", "expected": "آخر الأخبار في المساء", "pipeline_output": "آخر الأخبار في المساء", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 530, "punctuation_ms": 486, "spelling_ms": 1609, "total_ms": 2628}, "telemetry_events": [{"event": "grammar_raw_output", "input": "آخر الأخبار في المساء", "output": "آخر الأخبار في المساء"}]}
{"sample_id": "S020", "dataset": "spelling", "input": "اسرع في المشي قليلاً", "expected": "أسرع في المشي قليلاً", "pipeline_output": "أسرع في المشي قليلاً", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 680, "punctuation_ms": 376, "spelling_ms": 2519, "total_ms": 3577}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أسرع في المشي قليلاً", "output": "أسرع في المشي قليلا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "قليلا", "end": 20, "event": "grammar_diff", "original": "قليلاً", "start": 14}, {"correction": "قليلا", "event": "filter_reject", "filter": "TanweenGuard", "original": "قليلاً"}]}
{"sample_id": "S021", "dataset": "spelling", "input": "اجمل مكان في العالم", "expected": "أجمل مكان في العالم", "pipeline_output": "أجمل مكان في العالم", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 535, "punctuation_ms": 367, "spelling_ms": 1762, "total_ms": 2666}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أجمل مكان في العالم", "output": "أجمل مكان في العالم"}]}
{"sample_id": "S022", "dataset": "spelling", "input": "اعلن الرئيس عن القرار", "expected": "أعلن الرئيس عن القرار", "pipeline_output": "اعلن الرئيس عن القرار", "passed": false, "suggestion_count": 0, "timing": {"grammar_ms": 539, "punctuation_ms": 440, "spelling_ms": 1575, "total_ms": 2556}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اعلن الرئيس عن القرار", "output": "اعلن الرئيس عن القرار"}]}
{"sample_id": "S023", "dataset": "spelling", "input": "اكد الوزير على الخطة", "expected": "أكد الوزير على الخطة", "pipeline_output": "أكد الوزير على الخطة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 531, "punctuation_ms": 417, "spelling_ms": 1621, "total_ms": 2572}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أكد الوزير على الخطة", "output": "أكد الوزير على الخطة"}]}
{"sample_id": "S024", "dataset": "spelling", "input": "اشار التقرير إلى ذلك", "expected": "أشار التقرير إلى ذلك", "pipeline_output": "أشار التقرير إلى ذلك", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 487, "punctuation_ms": 324, "spelling_ms": 2113, "total_ms": 2927}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أشار التقرير إلى ذلك", "output": "أشار التقرير إلى ذلك"}]}
{"sample_id": "S025", "dataset": "spelling", "input": "اعتقد انه سيحضر غداً", "expected": "أعتقد أنه سيحضر غداً", "pipeline_output": "أعتقد انه سيحضر غداً", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 633, "punctuation_ms": 438, "spelling_ms": 1563, "total_ms": 2637}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أعتقد انه سيحضر غداً", "output": "أعتقد انه سيحضر غدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "غدا", "end": 20, "event": "grammar_diff", "original": "غداً", "start": 16}, {"correction": "غدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "غداً"}]}
{"sample_id": "S026", "dataset": "spelling", "input": "والاسعار مرتفعة جداً", "expected": "والأسعار مرتفعة جداً", "pipeline_output": "والأسعار مرتفعة جداً", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 643, "punctuation_ms": 402, "spelling_ms": 1879, "total_ms": 2927}, "telemetry_events": [{"event": "grammar_raw_output", "input": "والأسعار مرتفعة جداً", "output": "والأسعار مرتفعة جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 20, "event": "grammar_diff", "original": "جداً", "start": 16}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]}
{"sample_id": "S027", "dataset": "spelling", "input": "بالاضافة إلى ذلك", "expected": "بالإضافة إلى ذلك", "pipeline_output": "بالإضافة إلى ذلك", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 484, "punctuation_ms": 346, "spelling_ms": 2164, "total_ms": 2996}, "telemetry_events": [{"event": "grammar_raw_output", "input": "بالاضافة إلى ذلك", "output": "بالإضافة إلى ذلك"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "بالإضافة", "end": 8, "event": "grammar_diff", "original": "بالاضافة", "start": 0}, {"correction": "بالإضافة", "end": 8, "event": "patch_accepted", "original": "بالاضافة", "stage": "spelling", "start": 0}]}
{"sample_id": "S028", "dataset": "spelling", "input": "فالانسان يحتاج للعلم", "expected": "فالإنسان يحتاج للعلم", "pipeline_output": "فالانسان يحتاج للعلم", "passed": false, "suggestion_count": 0, "timing": {"grammar_ms": 582, "punctuation_ms": 536, "spelling_ms": 3461, "total_ms": 4581}, "telemetry_events": [{"event": "grammar_raw_output", "input": "فالانسان يحتاج للعلم", "output": "فالانسان يحتاج للعلم"}]}
{"sample_id": "S029", "dataset": "spelling", "input": "كالاطفال في اللعب", "expected": "كالأطفال في اللعب", "pipeline_output": "كلا الأطفال في اللعب", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 731, "punctuation_ms": 440, "spelling_ms": 3356, "total_ms": 4528}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كلا الأطفال في اللعب", "output": "كلا الأطفال في اللعب"}]}
{"sample_id": "S030", "dataset": "spelling", "input": "للاسف لم ينجح", "expected": "للأسف لم ينجح", "pipeline_output": "للأسف لم ينجح", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 478, "punctuation_ms": 445, "spelling_ms": 1906, "total_ms": 2831}, "telemetry_events": [{"event": "grammar_raw_output", "input": "للاسف لم ينجح", "output": "للأسف لم ينجح"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "للأسف", "end": 5, "event": "grammar_diff", "original": "للاسف", "start": 0}, {"correction": "للأسف", "end": 5, "event": "patch_accepted", "original": "للاسف", "stage": "spelling", "start": 0}]}
{"sample_id": "S031", "dataset": "spelling", "input": "المدرسه كبيره وجميله", "expected": "المدرسة كبيرة وجميلة", "pipeline_output": "المدرسة كبيرة وجميلة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 542, "punctuation_ms": 521, "spelling_ms": 1764, "total_ms": 2830}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المدرسة كبيرة وجميلة", "output": "المدرسة كبيرة وجميلة"}]}
{"sample_id": "S032", "dataset": "spelling", "input": "الجامعه في القاهره", "expected": "الجامعة في القاهرة", "pipeline_output": "الجامعة في القاهرة", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 537, "punctuation_ms": 474, "spelling_ms": 3601, "total_ms": 4615}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الجامعة في القاهرة", "output": "الجامعة في القاهرة"}]}
{"sample_id": "S033", "dataset": "spelling", "input": "السياره سريعه جداً", "expected": "السيارة سريعة جداً", "pipeline_output": "السيارة سريعة جداً", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 637, "punctuation_ms": 458, "spelling_ms": 2995, "total_ms": 4093}, "telemetry_events": [{"event": "grammar_raw_output", "input": "السيارة سريعة جداً", "output": "السيارة سريعة جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 18, "event": "grammar_diff", "original": "جداً", "start": 14}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]}
{"sample_id": "S034", "dataset": "spelling", "input": "الشجره طويله وجميله", "expected": "الشجرة طويلة وجميلة", "pipeline_output": "الشجرة طويلة وجميلة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 492, "punctuation_ms": 486, "spelling_ms": 1971, "total_ms": 2952}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الشجرة طويلة وجميلة", "output": "الشجرة طويلة وجميلة"}]}
{"sample_id": "S035", "dataset": "spelling", "input": "الحياه صعبه في المدينه", "expected": "الحياة صعبة في المدينة", "pipeline_output": "الحياة صعبة في المدينة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 686, "punctuation_ms": 556, "spelling_ms": 2381, "total_ms": 3631}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الحياه صعبة في المدينة", "output": "الحياة صعبة في المدينة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الحياة", "end": 6, "event": "grammar_diff", "original": "الحياه", "start": 0}, {"correction": "الحياة", "end": 6, "event": "patch_accepted", "original": "الحياه", "stage": "spelling", "start": 0}]}
{"sample_id": "S036", "dataset": "spelling", "input": "المكتبه قريبه من البيت", "expected": "المكتبة قريبة من البيت", "pipeline_output": "المكتبة قريبة من البيت", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 636, "punctuation_ms": 495, "spelling_ms": 3443, "total_ms": 4576}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المكتبة قريبة من البيت", "output": "المكتبة قريبة من البيت"}]}
{"sample_id": "S037", "dataset": "spelling", "input": "الغرفه نظيفه ومرتبه", "expected": "الغرفة نظيفة ومرتبة", "pipeline_output": "الغرفة نظيفة ومرتبة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 593, "punctuation_ms": 608, "spelling_ms": 3667, "total_ms": 4872}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الغرفة نظيفة ومرتبة", "output": "الغرفة نظيفة ومرتبة"}]}
{"sample_id": "S038", "dataset": "spelling", "input": "القصه مثيره للاهتمام", "expected": "القصة مثيرة للاهتمام", "pipeline_output": "القصة مثيرة للاهتمام", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 582, "punctuation_ms": 451, "spelling_ms": 2431, "total_ms": 3466}, "telemetry_events": [{"event": "grammar_raw_output", "input": "القصة مثيرة للاهتمام", "output": "القصة مثيرة للاهتمام"}]}
{"sample_id": "S039", "dataset": "spelling", "input": "الرحله طويله ومتعبه", "expected": "الرحلة طويلة ومتعبة", "pipeline_output": "الرحلة طويلة ومتعبة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 642, "punctuation_ms": 583, "spelling_ms": 2151, "total_ms": 3379}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الرحلة طويلة ومتعبة", "output": "الرحلة طويلة ومتعبة"}]}
{"sample_id": "S040", "dataset": "spelling", "input": "الوظيفه صعبه لكنها مفيده", "expected": "الوظيفة صعبة لكنها مفيدة", "pipeline_output": "الوظيفة صعبة لكنها مفيدة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 539, "punctuation_ms": 565, "spelling_ms": 2859, "total_ms": 3967}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الوظيفه صعبة لكنها مفيدة", "output": "الوظيفة صعبة لكنها مفيدة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الوظيفة", "end": 7, "event": "grammar_diff", "original": "الوظيفه", "start": 0}, {"correction": "الوظيفة", "end": 7, "event": "patch_accepted", "original": "الوظيفه", "stage": "spelling", "start": 0}]}
{"sample_id": "S041", "dataset": "spelling", "input": "بالمدرسه الكبيره", "expected": "بالمدرسة الكبيرة", "pipeline_output": "بالمدرسة الكبيرة", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 382, "punctuation_ms": 473, "spelling_ms": 3754, "total_ms": 4611}, "telemetry_events": [{"event": "grammar_raw_output", "input": "بالمدرسة الكبيرة", "output": "بالمدرسة الكبيرة"}]}
{"sample_id": "S042", "dataset": "spelling", "input": "والجامعه المصريه", "expected": "والجامعة المصرية", "pipeline_output": "والجامعة المصرية", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 490, "punctuation_ms": 398, "spelling_ms": 2364, "total_ms": 3255}, "telemetry_events": [{"event": "grammar_raw_output", "input": "والجامعة المصريه", "output": "والجامعة المصرية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المصرية", "end": 16, "event": "grammar_diff", "original": "المصريه", "start": 9}, {"correction": "المصرية", "end": 16, "event": "patch_accepted", "original": "المصريه", "stage": "spelling", "start": 9}]}
{"sample_id": "S043", "dataset": "spelling", "input": "فالسياره الجديده", "expected": "فالسيارة الجديدة", "pipeline_output": "فالسيارة الجديدة", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 429, "punctuation_ms": 514, "spelling_ms": 3404, "total_ms": 4350}, "telemetry_events": [{"event": "grammar_raw_output", "input": "فالسياره الجديدة", "output": "فالسيارة الجديدة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "فالسيارة", "end": 8, "event": "grammar_diff", "original": "فالسياره", "start": 0}, {"correction": "فالسيارة", "end": 8, "event": "patch_accepted", "original": "فالسياره", "stage": "spelling", "start": 0}]}
{"sample_id": "S044", "dataset": "spelling", "input": "كالمدرسه القديمه", "expected": "كالمدرسة القديمة", "pipeline_output": "كالمدرسة القديمة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 528, "punctuation_ms": 549, "spelling_ms": 2921, "total_ms": 4000}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كالمدرسه القديمه", "output": "كالمدرسة القديمة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "كالمدرسة القديمة", "end": 16, "event": "grammar_diff", "original": "كالمدرسه القديمه", "start": 0}, {"correction": "كالمدرسة القديمة", "end": 16, "event": "patch_accepted", "original": "كالمدرسه القديمه", "stage": "spelling", "start": 0}]}
{"sample_id": "S045", "dataset": "spelling", "input": "للمدرسه الابتدائيه", "expected": "للمدرسة الابتدائية", "pipeline_output": "للمدرسة الابتدائية", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 349, "punctuation_ms": 547, "spelling_ms": 3247, "total_ms": 4147}, "telemetry_events": [{"event": "grammar_raw_output", "input": "للمدرسة الابتدائية", "output": "للمدرسة الابتدائية"}]}
{"sample_id": "S046", "dataset": "spelling", "input": "ذهبت الي المكتبة", "expected": "ذهبت إلى المكتبة", "pipeline_output": "ذهبت إلى المكتبة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 481, "punctuation_ms": 424, "spelling_ms": 1726, "total_ms": 2633}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى المكتبة", "output": "ذهبت إلى المكتبة"}]}
{"sample_id": "S047", "dataset": "spelling", "input": "المستشفي الكبير", "expected": "المستشفى الكبير", "pipeline_output": "المستشفى الكبير", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 328, "punctuation_ms": 383, "spelling_ms": 1189, "total_ms": 1903}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المستشفى الكبير", "output": "المستشفى الكبير"}]}
{"sample_id": "S048", "dataset": "spelling", "input": "هدي الطالبة ممتاز", "expected": "هدى الطالبة ممتاز", "pipeline_output": "هدى الطالبة ممتازة", "passed": false, "suggestion_count": 2, "timing": {"grammar_ms": 487, "punctuation_ms": 518, "spelling_ms": 1433, "total_ms": 2441}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هدى الطالبة ممتاز", "output": "هدى الطالبة ممتازة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "ممتازة", "end": 17, "event": "grammar_diff", "original": "ممتاز", "start": 12}, {"correction": "ممتازة", "end": 17, "event": "patch_accepted", "original": "ممتاز", "stage": "grammar", "start": 12}]}
{"sample_id": "S049", "dataset": "spelling", "input": "مصطفي طالب مجتهد", "expected": "مصطفى طالب مجتهد", "pipeline_output": "مصطفى طالب مجتهد", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 734, "punctuation_ms": 307, "spelling_ms": 1402, "total_ms": 2445}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مصطفى طالب مجتهد", "output": "مصطفى طالب مجتهد"}]}
{"sample_id": "S050", "dataset": "spelling", "input": "موسي نبي عظيم", "expected": "موسى نبي عظيم", "pipeline_output": "موسى نبي عظيم", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 481, "punctuation_ms": 281, "spelling_ms": 1618, "total_ms": 2382}, "telemetry_events": [{"event": "grammar_raw_output", "input": "موسى نبي عظيم", "output": "موسى نبي عظيم"}]}
{"sample_id": "S051", "dataset": "spelling", "input": "علي يدرس في الكلية", "expected": "علي يدرس في الكلية", "pipeline_output": "علي يدرس في الكلية", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 542, "punctuation_ms": 411, "spelling_ms": 1639, "total_ms": 2593}, "telemetry_events": [{"event": "grammar_raw_output", "input": "علي يدرس في الكلية", "output": "علي يدرس في الكلية"}]}
{"sample_id": "S052", "dataset": "spelling", "input": "ذهب الي السوق", "expected": "ذهب إلى السوق", "pipeline_output": "ذهب إلى السوق", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 432, "punctuation_ms": 324, "spelling_ms": 1804, "total_ms": 2563}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهب إلى السوق", "output": "ذهب إلى السوق"}]}
{"sample_id": "S053", "dataset": "spelling", "input": "بني المبنى الجديد", "expected": "بنى المبنى الجديد", "pipeline_output": "بنى المبنى الجديد", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 438, "punctuation_ms": 410, "spelling_ms": 1701, "total_ms": 2552}, "telemetry_events": [{"event": "grammar_raw_output", "input": "بنى المبنى الجديد", "output": "بنى المبنى الجديد"}]}
{"sample_id": "S054", "dataset": "spelling", "input": "ذهبت فيالبيت", "expected": "ذهبت في البيت", "pipeline_output": "ذهبت في البيت", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 484, "punctuation_ms": 390, "spelling_ms": 1501, "total_ms": 2377}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت في البيت", "output": "ذهبت في البيت"}]}
{"sample_id": "S055", "dataset": "spelling", "input": "خرج منالمدرسة", "expected": "خرج من المدرسة", "pipeline_output": "خرج من المدرسة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 433, "punctuation_ms": 471, "spelling_ms": 2338, "total_ms": 3245}, "telemetry_events": [{"event": "grammar_raw_output", "input": "خرج من المدرسة", "output": "خرج من المدرسة"}]}
{"sample_id": "S056", "dataset": "spelling", "input": "بقي عندالباب", "expected": "بقي عند الباب", "pipeline_output": "بقي عند الباب", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 437, "punctuation_ms": 338, "spelling_ms": 1355, "total_ms": 2131}, "telemetry_events": [{"event": "grammar_raw_output", "input": "بقي عند الباب", "output": "بقي عند الباب"}]}
{"sample_id": "S057", "dataset": "spelling", "input": "جلس عندالنافذة", "expected": "جلس عند النافذة", "pipeline_output": "جلس عند النافذة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 532, "punctuation_ms": 433, "spelling_ms": 1373, "total_ms": 2339}, "telemetry_events": [{"event": "grammar_raw_output", "input": "جلس عند النافذة", "output": "جلس عند النافذة"}]}
{"sample_id": "S058", "dataset": "spelling", "input": "رجع الىالبيت", "expected": "رجع إلى البيت", "pipeline_output": "رجع إلى البيت", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 482, "punctuation_ms": 329, "spelling_ms": 2327, "total_ms": 3140}, "telemetry_events": [{"event": "grammar_raw_output", "input": "رجع إلى البيت", "output": "رجع إلى البيت"}]}
{"sample_id": "S059", "dataset": "spelling", "input": "خرج منالباب الخلفي", "expected": "خرج من الباب الخلفي", "pipeline_output": "خرج من الباب الخلفي", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 535, "punctuation_ms": 423, "spelling_ms": 1516, "total_ms": 2476}, "telemetry_events": [{"event": "grammar_raw_output", "input": "خرج من الباب الخلفي", "output": "خرج من الباب الخلفي"}]}
{"sample_id": "S060", "dataset": "spelling", "input": "نظر الىالسماء", "expected": "نظر إلى السماء", "pipeline_output": "نظر إلى السماء", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 533, "punctuation_ms": 341, "spelling_ms": 1877, "total_ms": 2752}, "telemetry_events": [{"event": "grammar_raw_output", "input": "نظر إلى السماء", "output": "نظر إلى السماء"}]}
{"sample_id": "S061", "dataset": "spelling", "input": "أنا ذهبت إلى الجامعة", "expected": "أنا ذهبت إلى الجامعة", "pipeline_output": "أنا ذهبت إلى الجامعة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 656, "punctuation_ms": 436, "spelling_ms": 1618, "total_ms": 2712}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أنا ذهبت إلى الجامعة", "output": "أنا ذهبت إلى الجامعة"}]}
{"sample_id": "S062", "dataset": "spelling", "input": "هذه المدرسة جميلة جداً", "expected": "هذه المدرسة جميلة جداً", "pipeline_output": "هذه المدرسة جميلة جداً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 688, "punctuation_ms": 571, "spelling_ms": 1694, "total_ms": 2955}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هذه المدرسة جميلة جداً", "output": "هذه المدرسة جميلة جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 22, "event": "grammar_diff", "original": "جداً", "start": 18}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]}
{"sample_id": "S063", "dataset": "spelling", "input": "كان الجو ممطراً اليوم", "expected": "كان الجو ممطراً اليوم", "pipeline_output": "كان الجو ممطراً اليوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 932, "punctuation_ms": 476, "spelling_ms": 2105, "total_ms": 3514}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كان الجو ممطراً اليوم", "output": "كان الجو ممطرا اليوم"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "ممطرا", "end": 15, "event": "grammar_diff", "original": "ممطراً", "start": 9}, {"correction": "ممطرا", "event": "filter_reject", "filter": "TanweenGuard", "original": "ممطراً"}]}
{"sample_id": "S064", "dataset": "spelling", "input": "وكان أحمد في المنزل", "expected": "وكان أحمد في المنزل", "pipeline_output": "وكان أحمد في المنزل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 582, "punctuation_ms": 413, "spelling_ms": 1611, "total_ms": 2608}, "telemetry_events": [{"event": "grammar_raw_output", "input": "وكان أحمد في المنزل", "output": "وكان أحمد في المنزل"}]}
{"sample_id": "S065", "dataset": "spelling", "input": "إلى اللقاء يا صديقي", "expected": "إلى اللقاء يا صديقي", "pipeline_output": "إلى اللقاء يا صديقي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 534, "punctuation_ms": 369, "spelling_ms": 1929, "total_ms": 2834}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إلى اللقاء يا صديقي", "output": "إلى اللقاء يا صديقي"}]}
{"sample_id": "S066", "dataset": "spelling", "input": "ذلك الكتاب مفيد جداً", "expected": "ذلك الكتاب مفيد جداً", "pipeline_output": "ذلك الكتاب مفيد جداً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 636, "punctuation_ms": 364, "spelling_ms": 1924, "total_ms": 2927}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذلك الكتاب مفيد جداً", "output": "ذلك الكتاب مفيد جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 20, "event": "grammar_diff", "original": "جداً", "start": 16}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]}
{"sample_id": "S067", "dataset": "spelling", "input": "لكن الأمر صعب علينا", "expected": "لكن الأمر صعب علينا", "pipeline_output": "لكن الأمر صعب علينا", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 536, "punctuation_ms": 417, "spelling_ms": 1946, "total_ms": 2901}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لكن الأمر صعب علينا", "output": "لكن الأمر صعب علينا"}]}
{"sample_id": "S068", "dataset": "spelling", "input": "هذا أو ذاك سواء عندي", "expected": "هذا أو ذاك سواء عندي", "pipeline_output": "هذا أو ذاك سواء عندي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 585, "punctuation_ms": 470, "spelling_ms": 2505, "total_ms": 3561}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هذا أو ذاك سواء عندي", "output": "هذا أو ذاك سواء عندي"}]}
{"sample_id": "S069", "dataset": "spelling", "input": "الطالب المجتهد ينجح دائماً", "expected": "الطالب المجتهد ينجح دائماً", "pipeline_output": "الطالب المجتهد ينجح دائماً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 695, "punctuation_ms": 497, "spelling_ms": 1750, "total_ms": 2945}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الطالب المجتهد ينجح دائماً", "output": "الطالب المجتهد ينجح دائما"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "دائما", "end": 26, "event": "grammar_diff", "original": "دائماً", "start": 20}, {"correction": "دائما", "event": "filter_reject", "filter": "TanweenGuard", "original": "دائماً"}]}
{"sample_id": "S070", "dataset": "spelling", "input": "العلم نور والجهل ظلام", "expected": "العلم نور والجهل ظلام", "pipeline_output": "العلم نور والجهل ظلام", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 706, "punctuation_ms": 496, "spelling_ms": 2873, "total_ms": 4076}, "telemetry_events": [{"event": "grammar_raw_output", "input": "العلم نور والجهل ظلام", "output": "العلم نور والجهل ظلام"}]}
{"sample_id": "S071", "dataset": "spelling", "input": "أحب القراءة والكتابة", "expected": "أحب القراءة والكتابة", "pipeline_output": "أحب القراءة والكتابة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 435, "punctuation_ms": 448, "spelling_ms": 1342, "total_ms": 2227}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أحب القراءة والكتابة", "output": "أحب القراءة والكتابة"}]}
{"sample_id": "S072", "dataset": "spelling", "input": "المعلم يشرح الدرس", "expected": "المعلم يشرح الدرس", "pipeline_output": "المعلم يشرح الدرس", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 476, "punctuation_ms": 408, "spelling_ms": 1410, "total_ms": 2296}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المعلم يشرح الدرس", "output": "المعلم يشرح الدرس"}]}
{"sample_id": "S073", "dataset": "spelling", "input": "ذهبت إلى السوق واشتريت خبزاً", "expected": "ذهبت إلى السوق واشتريت خبزاً", "pipeline_output": "ذهبت إلى السوق واشتريت خبزاً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 898, "punctuation_ms": 660, "spelling_ms": 2355, "total_ms": 3915}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى السوق واشتريت خبزاً", "output": "ذهبت إلى السوق واشتريت خبزا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "خبزا", "end": 28, "event": "grammar_diff", "original": "خبزاً", "start": 23}, {"correction": "خبزا", "event": "filter_reject", "filter": "TanweenGuard", "original": "خبزاً"}]}
{"sample_id": "S074", "dataset": "spelling", "input": "الطقس جميل في الربيع", "expected": "الطقس جميل في الربيع", "pipeline_output": "الطقس جميل في الربيع", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 632, "punctuation_ms": 402, "spelling_ms": 1628, "total_ms": 2663}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الطقس جميل في الربيع", "output": "الطقس جميل في الربيع"}]}
{"sample_id": "S075", "dataset": "spelling", "input": "نحن نعمل بجد كل يوم", "expected": "نحن نعمل بجد كل يوم", "pipeline_output": "نحن نعمل بجد كل يوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 581, "punctuation_ms": 354, "spelling_ms": 2854, "total_ms": 3791}, "telemetry_events": [{"event": "grammar_raw_output", "input": "نحن نعمل بجد كل يوم", "output": "نحن نعمل بجد كل يوم"}]}
{"sample_id": "S076", "dataset": "spelling", "input": "انا ذهبت الي المدرسه", "expected": "أنا ذهبت إلى المدرسة", "pipeline_output": "أنا ذهبت إلى المدرسة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 536, "punctuation_ms": 417, "spelling_ms": 3213, "total_ms": 4169}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أنا ذهبت إلى المدرسة", "output": "أنا ذهبت إلى المدرسة"}]}
{"sample_id": "S077", "dataset": "spelling", "input": "ايضا الجامعه كبيره", "expected": "أيضاً الجامعة كبيرة", "pipeline_output": "أيضا الجامعة هي كبيرة", "passed": false, "suggestion_count": 2, "timing": {"grammar_ms": 590, "punctuation_ms": 398, "spelling_ms": 2260, "total_ms": 3251}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ايضا الجامعه هي كبيرة", "output": "أيضا الجامعة هي كبيرة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "أيضا الجامعة", "end": 12, "event": "grammar_diff", "original": "ايضا الجامعه", "start": 0}, {"correction": "أيضا الجامعة", "end": 12, "event": "patch_accepted", "original": "ايضا الجامعه", "stage": "spelling", "start": 0}]}
{"sample_id": "S078", "dataset": "spelling", "input": "لان المدرسه بعيده جداً", "expected": "لأن المدرسة بعيدة جداً", "pipeline_output": "لأن المدرسة بعيدة جداً", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 686, "punctuation_ms": 532, "spelling_ms": 2533, "total_ms": 3754}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لأن المدرسة بعيدة جداً", "output": "لأن المدرسة بعيدة جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 22, "event": "grammar_diff", "original": "جداً", "start": 18}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]}
{"sample_id": "S079", "dataset": "spelling", "input": "اين الجامعه الكبيره", "expected": "أين الجامعة الكبيرة", "pipeline_output": "اين أن الجامعة الكبيرة", "passed": false, "suggestion_count": 2, "timing": {"grammar_ms": 535, "punctuation_ms": 534, "spelling_ms": 3206, "total_ms": 4277}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اين أن الجامعة الكبيرة", "output": "اين أن الجامعة الكبيرة"}]}
{"sample_id": "S080", "dataset": "spelling", "input": "اول مره ازور المكتبه", "expected": "أول مرة أزور المكتبة", "pipeline_output": "أول مرة أزور المكتبة", "passed": true, "suggestion_count": 4, "timing": {"grammar_ms": 591, "punctuation_ms": 457, "spelling_ms": 2472, "total_ms": 3523}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أول مرة أزور المكتبة", "output": "أول مرة أزور المكتبة"}]}
{"sample_id": "SC001", "dataset": "structured_content", "input": "زر الموقع https://example.com للمزيد", "expected": "زر الموقع https://example.com للمزيد", "pipeline_output": "زر الموقع https://example.com للمزيد", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 632, "punctuation_ms": 1073, "spelling_ms": 0, "total_ms": 1706}, "telemetry_events": [{"event": "grammar_raw_output", "input": "زر الموقع بيان للمزيد", "output": "زر الموقع بيانا للمزيد"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "https://example.comا", "end": 29, "event": "grammar_diff", "original": "https://example.com", "start": 10}, {"correction": "https://example.comا", "event": "filter_reject", "filter": "LatinGuard", "original": "https://example.com"}]}
{"sample_id": "SC002", "dataset": "structured_content", "input": "الرابط https://www.google.com/search?q=test يعمل", "expected": "الرابط https://www.google.com/search?q=test يعمل", "pipeline_output": "الرابط https://www.google.com/search?q=test يعمل", "passed": true, "suggestion_count": 0, "timing": {}, "telemetry_events": []}
{"sample_id": "SC003", "dataset": "structured_content", "input": "موقع http://localhost:8080/api جاهز", "expected": "موقع http://localhost:8080/api جاهز", "pipeline_output": "موقع http://localhost:8080/api جاهز", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 534, "punctuation_ms": 1395, "spelling_ms": 0, "total_ms": 1931}, "telemetry_events": [{"event": "grammar_raw_output", "input": "موقع بيان جاهز", "output": "موقع بيان جاهز"}]}
{"sample_id": "SC004", "dataset": "structured_content", "input": "اقرأ المقال على https://medium.com/@user/article-title", "expected": "اقرأ المقال على https://medium.com/@user/article-title", "pipeline_output": "اقرأ المقال على https://medium.com/@user/article-title", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 633, "punctuation_ms": 1880, "spelling_ms": 0, "total_ms": 2514}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اقرأ المقال على بيان", "output": "اقرأ المقال على بيان"}]}
{"sample_id": "SC005", "dataset": "structured_content", "input": "أرسل لي على info@company.com", "expected": "أرسل لي على info@company.com", "pipeline_output": "أرسل لي على info@company.com", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 530, "punctuation_ms": 713, "spelling_ms": 0, "total_ms": 1244}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أرسل لي على بيان", "output": "أرسل لي على بيان"}]}
{"sample_id": "SC006", "dataset": "structured_content", "input": "بريدي user.name@gmail.com للتواصل", "expected": "بريدي user.name@gmail.com للتواصل", "pipeline_output": "بريدي user.name@gmail.com للتواصل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 632, "punctuation_ms": 907, "spelling_ms": 0, "total_ms": 1540}, "telemetry_events": [{"event": "grammar_raw_output", "input": "بريدي بيانلتواصل", "output": "بريدي بيان للتواصل"}]}
{"sample_id": "SC007", "dataset": "structured_content", "input": "تواصل عبر support@bayan.ai", "expected": "تواصل عبر support@bayan.ai", "pipeline_output": "تواصل عبر support@bayan.ai", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 581, "punctuation_ms": 494, "spelling_ms": 0, "total_ms": 1076}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تواصل عبر بيان", "output": "تواصل عبر بيان"}]}
{"sample_id": "SC008", "dataset": "structured_content", "input": "تاريخ اليوم 15/06/2026", "expected": "تاريخ اليوم 15/06/2026", "pipeline_output": "تاريخ اليوم 15/06/2026", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 533, "punctuation_ms": 493, "spelling_ms": 6514, "total_ms": 7542}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تاريخ اليوم بيان", "output": "تاريخ اليوم بيان"}]}
{"sample_id": "SC009", "dataset": "structured_content", "input": "الموعد يوم 2026-06-22", "expected": "الموعد يوم 2026-06-22", "pipeline_output": "الموعد يوم 2026-06-22", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 634, "punctuation_ms": 629, "spelling_ms": 4981, "total_ms": 6246}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الموعد يوم 20بيان", "output": "الموعد يوم عشرين بيانا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "عشرين 26-06-22ا", "end": 21, "event": "grammar_diff", "original": "2026-06-22", "start": 11}, {"correction": "عشرين 26-06-22ا", "event": "filter_reject", "filter": "DigitGuard", "original": "2026-06-22"}]}
{"sample_id": "SC010", "dataset": "structured_content", "input": "في تاريخ 01/01/2025 بدأنا", "expected": "في تاريخ 01/01/2025 بدأنا", "pipeline_output": "في تاريخ 01/01/2025 بدأنا", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 533, "punctuation_ms": 681, "spelling_ms": 5836, "total_ms": 7052}, "telemetry_events": [{"event": "grammar_raw_output", "input": "في تاريخ بيان بدأنا", "output": "في تاريخ بيان بدأنا"}]}
{"sample_id": "SC011", "dataset": "structured_content", "input": "الساعة 14:30 عصراً", "expected": "الساعة 14:30 عصراً", "pipeline_output": "الساعة 14:30 عصراً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 587, "punctuation_ms": 518, "spelling_ms": 4659, "total_ms": 5766}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الساعة بيان عصراً", "output": "الساعة بيان عصرا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "عصرا", "end": 18, "event": "grammar_diff", "original": "عصراً", "start": 13}, {"correction": "عصرا", "event": "filter_reject", "filter": "TanweenGuard", "original": "عصراً"}]}
{"sample_id": "SC012", "dataset": "structured_content", "input": "الموعد الساعة 3:30 مساءً", "expected": "الموعد الساعة 3:30 مساءً", "pipeline_output": "الموعد الساعة 3:30 مساءً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 834, "punctuation_ms": 598, "spelling_ms": 4998, "total_ms": 6432}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الموعد الساعة بيان مساءً", "output": "الموعد الساعة بيان مساء"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "مساء", "end": 24, "event": "grammar_diff", "original": "مساءً", "start": 19}, {"correction": "مساء", "event": "filter_reject", "filter": "TanweenGuard", "original": "مساءً"}]}
{"sample_id": "SC013", "dataset": "structured_content", "input": "يبدأ الاجتماع 09:00 صباحاً", "expected": "يبدأ الاجتماع 09:00 صباحاً", "pipeline_output": "يبدأ الاجتماع 09:00 صباحاً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 782, "punctuation_ms": 787, "spelling_ms": 7055, "total_ms": 8626}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يبدأ الاجتماع بيان صباحاً", "output": "يبدأ الاجتماع بيانا صباحا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "09:00ا صباحا", "end": 26, "event": "grammar_diff", "original": "09:00 صباحاً", "start": 14}, {"correction": "09:00ا صباحا", "event": "filter_reject", "filter": "DigitGuard", "original": "09:00 صباحاً"}]}
{"sample_id": "SC014", "dataset": "structured_content", "input": "المسافة 25.5 كيلومتر", "expected": "المسافة 25.5 كيلومتر", "pipeline_output": "المسافة 25.5 كيلومتر", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 682, "punctuation_ms": 442, "spelling_ms": 5551, "total_ms": 6677}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المسافة 25.5 كيلومتر", "output": "المسافة ثلاث عشر كيلومترا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "ثلاث عشر كيلومترا", "end": 20, "event": "grammar_diff", "original": "25.5 كيلومتر", "start": 8}, {"correction": "ثلاث عشر كيلومترا", "event": "filter_reject", "filter": "DigitGuard", "original": "25.5 كيلومتر"}]}
{"sample_id": "SC015", "dataset": "structured_content", "input": "السعر 1,000,000 جنيه", "expected": "السعر 1,000,000 جنيه", "pipeline_output": "السعر 1,000,000 جنيه", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 491, "punctuation_ms": 723, "spelling_ms": 4163, "total_ms": 5379}, "telemetry_events": [{"event": "grammar_raw_output", "input": "السعر 1,000,000 جنيه", "output": "السعر 1 , 000 , 000 جنيه"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "1 , 000 , 000", "end": 15, "event": "grammar_diff", "original": "1,000,000", "start": 6}, {"correction": "1 , 000 , 000", "event": "filter_reject", "filter": "DigitGuard", "original": "1,000,000"}]}
{"sample_id": "SC016", "dataset": "structured_content", "input": "النسبة 95.7% من الطلاب نجحوا", "expected": "النسبة 95.7% من الطلاب نجحوا", "pipeline_output": "النسبة 95.7% من الطلاب نجحوا", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 833, "punctuation_ms": 891, "spelling_ms": 0, "total_ms": 1725}, "telemetry_events": [{"event": "grammar_raw_output", "input": "النسبة 95.7% من الطلاب نجحوا", "output": "النسبة 95 ، 7 % من الطلاب نجحوا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "95 ، 7 %", "end": 12, "event": "grammar_diff", "original": "95.7%", "start": 7}, {"correction": "95 ، 7 %", "event": "filter_reject", "filter": "DigitGuard", "original": "95.7%"}]}
{"sample_id": "SC017", "dataset": "structured_content", "input": "الثمن 500$ أمريكي", "expected": "الثمن 500$ أمريكي", "pipeline_output": "الثمن 500$ أمريكي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 534, "punctuation_ms": 480, "spelling_ms": 2624, "total_ms": 3640}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الثمن 500$ أمريكي", "output": "الثمن 500 $ أمريكي"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "500 $", "end": 10, "event": "grammar_diff", "original": "500$", "start": 6}]}
{"sample_id": "SC018", "dataset": "structured_content", "input": "الميزانية 100 جنيه مصري", "expected": "الميزانية 100 جنيه مصري", "pipeline_output": "الميزانية 100 جنيه مصري", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 494, "punctuation_ms": 415, "spelling_ms": 2138, "total_ms": 3049}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الميزانية 100 جنيه مصري", "output": "الميزانية مائة جنيه مصري"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "مائة", "end": 13, "event": "grammar_diff", "original": "100", "start": 10}, {"correction": "مائة", "event": "filter_reject", "filter": "Jaccard_03", "jaccard": 0.0, "original": "100"}]}
{"sample_id": "SC019", "dataset": "structured_content", "input": "الحرارة 35°C اليوم", "expected": "الحرارة 35°C اليوم", "pipeline_output": "الحرارة 35°C اليوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 678, "punctuation_ms": 455, "spelling_ms": 1951, "total_ms": 3085}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الحرارة 35°C اليوم", "output": "الحرارة 35 ° C اليوم"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "35 ° C", "end": 12, "event": "grammar_diff", "original": "35°C", "start": 8}, {"correction": "35 ° C", "event": "filter_reject", "filter": "LatinGuard", "original": "35°C"}]}
{"sample_id": "SC020", "dataset": "structured_content", "input": "المسافة 25km تقريباً", "expected": "المسافة 25km تقريباً", "pipeline_output": "المسافة 25km تقريباً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 730, "punctuation_ms": 537, "spelling_ms": 4165, "total_ms": 5434}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المسافة 25km تقريباً", "output": "المسافة 25km تقريبا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "تقريبا", "end": 20, "event": "grammar_diff", "original": "تقريباً", "start": 13}, {"correction": "تقريبا", "event": "filter_reject", "filter": "TanweenGuard", "original": "تقريباً"}]}
{"sample_id": "SC021", "dataset": "structured_content", "input": "الوزن 75kg", "expected": "الوزن 75kg", "pipeline_output": "الوزن 75kg", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 623, "punctuation_ms": 443, "spelling_ms": 2716, "total_ms": 3785}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الوزن 75kg", "output": "الوزن75kg"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الوزن75kg", "end": 10, "event": "grammar_diff", "original": "الوزن 75kg", "start": 0}, {"correction": "الوزن75kg", "event": "filter_reject", "filter": "LatinGuard", "original": "الوزن 75kg"}]}
{"sample_id": "SC022", "dataset": "structured_content", "input": "استخدم print('مرحبا') للطباعة", "expected": "استخدم print('مرحبا') للطباعة", "pipeline_output": "استخدم print('مرحبا') للطباعة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1228, "punctuation_ms": 873, "spelling_ms": 0, "total_ms": 2103}, "telemetry_events": [{"event": "grammar_raw_output", "input": "استخدم print('مرحبا') للطباعة", "output": "استخدم print ، ' مرحباا ، للطباعة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "print ، ' مرحباا ،", "end": 21, "event": "grammar_diff", "original": "print('مرحبا')", "start": 7}, {"correction": "print ، ' مرحباا ،", "event": "filter_reject", "filter": "LatinGuard", "original": "print('مرحبا')"}]}
{"sample_id": "SC023", "dataset": "structured_content", "input": "المتغير const x = 5; في جافاسكريبت", "expected": "المتغير const x = 5; في جافاسكريبت", "pipeline_output": "المتغير const x = 5; في جافاسكريبت", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1384, "punctuation_ms": 976, "spelling_ms": 0, "total_ms": 2362}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المتغير const x = 5; في جافاسكريبت", "output": "المتغير const x = خمسة ; في جافاسكريبت"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "خمسة ;", "end": 20, "event": "grammar_diff", "original": "5;", "start": 18}, {"correction": "خمسة ;", "event": "filter_reject", "filter": "Jaccard_03", "jaccard": 0.167, "original": "5;"}]}
{"sample_id": "SC024", "dataset": "structured_content", "input": "الدالة function test() {} تعمل", "expected": "الدالة function test() {} تعمل", "pipeline_output": "الدالة function test() {} تعمل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1443, "punctuation_ms": 635, "spelling_ms": 0, "total_ms": 2080}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الدالة function test() {} تعمل", "output": "الدالة function test ، وذلك { } تعمل"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "test ، وذلك { }", "end": 25, "event": "grammar_diff", "original": "test() {}", "start": 16}, {"correction": "test ، وذلك { }", "event": "filter_reject", "filter": "LatinGuard", "original": "test() {}"}]}
{"sample_id": "SC025", "dataset": "structured_content", "input": "الاستعلام SELECT * FROM users يعمل", "expected": "الاستعلام SELECT * FROM users يعمل", "pipeline_output": "الاستعلام SELECT * FROM users يعمل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1079, "punctuation_ms": 740, "spelling_ms": 0, "total_ms": 1820}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الاستعلام SELECT * FROM users يعمل", "output": "الاستعلام SELECT * FROM users يعمل"}]}
{"sample_id": "SC026", "dataset": "structured_content", "input": "البيانات {\"name\":\"Mohamed\"} صحيحة", "expected": "البيانات {\"name\":\"Mohamed\"} صحيحة", "pipeline_output": "البيانات {\"name\":\"Mohamed\"} صحيحة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1435, "punctuation_ms": 1153, "spelling_ms": 0, "total_ms": 2589}, "telemetry_events": [{"event": "grammar_raw_output", "input": "البيانات {\"name\":\"Mohamed\"} صحيحة", "output": "البيانات { \" name \" : \" Mohamed \" } صحيحة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "{ \" name \" : \" Mohamed \" }", "end": 27, "event": "grammar_diff", "original": "{\"name\":\"Mohamed\"}", "start": 9}, {"correction": "{ \" name \" : \" Mohamed \" }", "event": "filter_reject", "filter": "LatinGuard", "original": "{\"name\":\"Mohamed\"}"}]}
{"sample_id": "SC027", "dataset": "structured_content", "input": "مشروع #بيان رائع جداً", "expected": "مشروع #بيان رائع جداً", "pipeline_output": "مشروع #بيان رائع جداً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 733, "punctuation_ms": 379, "spelling_ms": 0, "total_ms": 1114}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مشروع بيان رائع جداً", "output": "مشروع بيان رائع جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 21, "event": "grammar_diff", "original": "جداً", "start": 17}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]}
{"sample_id": "SC028", "dataset": "structured_content", "input": "هاشتاق #الذكاء_الاصطناعي مهم", "expected": "هاشتاق #الذكاء_الاصطناعي مهم", "pipeline_output": "هاشتاق #الذكاء_الاصطناعي مهم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 528, "punctuation_ms": 552, "spelling_ms": 0, "total_ms": 1082}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هاشتاق بيان مهم", "output": "هاشتاق بيان مهم"}]}
{"sample_id": "SC029", "dataset": "structured_content", "input": "شكراً @mohamedatef على المساعدة", "expected": "شكراً @mohamedatef على المساعدة", "pipeline_output": "شكراً @mohamedatef على المساعدة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 692, "punctuation_ms": 944, "spelling_ms": 0, "total_ms": 1638}, "telemetry_events": [{"event": "grammar_raw_output", "input": "شكراً بيان على المساعدة", "output": "شكرا بيان على المساعدة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "شكرا", "end": 5, "event": "grammar_diff", "original": "شكراً", "start": 0}, {"correction": "شكرا", "event": "filter_reject", "filter": "TanweenGuard", "original": "شكراً"}]}
{"sample_id": "SC030", "dataset": "structured_content", "input": "تابع @bayan_app للتحديثات", "expected": "تابع @bayan_app للتحديثات", "pipeline_output": "تابع @bayan_app للتحديثات", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 734, "punctuation_ms": 5888, "spelling_ms": 5837, "total_ms": 12461}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تابع بيان للتحديثات", "output": "تابع بيان للتحديثات"}]}
{"sample_id": "SC031", "dataset": "structured_content", "input": "اتصل على 01012345678 للاستفسار", "expected": "اتصل على 01012345678 للاستفسار", "pipeline_output": "اتصل على 01012345678 للاستفسار", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 630, "punctuation_ms": 645, "spelling_ms": 4861, "total_ms": 6138}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اتصل على بيان للاستفسار", "output": "اتصل على بيان للاستفسار"}]}
{"sample_id": "SC032", "dataset": "structured_content", "input": "الرقم +201012345678 متاح", "expected": "الرقم +201012345678 متاح", "pipeline_output": "الرقم +201012345678 متاح", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 480, "punctuation_ms": 516, "spelling_ms": 6117, "total_ms": 7115}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الرقم بيان متاح", "output": "الرقم بيان متاح"}]}
{"sample_id": "SC033", "dataset": "structured_content", "input": "الخادم على 192.168.1.1 يعمل", "expected": "الخادم على 192.168.1.1 يعمل", "pipeline_output": "الخادم على 192.168.1.1 يعمل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 631, "punctuation_ms": 514, "spelling_ms": 8901, "total_ms": 10049}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الخادم على بيان يعمل", "output": "الخادم على بيان يعمل"}]}
{"sample_id": "SC034", "dataset": "structured_content", "input": "الإصدار v2.1.0 متاح", "expected": "الإصدار v2.1.0 متاح", "pipeline_output": "الإصدار v2.1.0 متاح", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 480, "punctuation_ms": 501, "spelling_ms": 6267, "total_ms": 7249}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الإصدار بيان متاح", "output": "الإصدار بيان متاح"}]}
{"sample_id": "SC035", "dataset": "structured_content", "input": "الملف في C:\\Users\\test\\file.txt", "expected": "الملف في C:\\Users\\test\\file.txt", "pipeline_output": "الملف في C:\\Users\\test\\file.txt", "passed": true, "suggestion_count": 0, "timing": {}, "telemetry_events": []}
|