| {"sample_id": "E001", "dataset": "entities", "input": "محمد صلاح لاعب كرة قدم مصري", "expected": "محمد صلاح لاعب كرة قدم مصري", "pipeline_output": "محمد صلاح لاعب كرة قدم مصري", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 769, "punctuation_ms": 536, "spelling_ms": 671, "total_ms": 1978}, "telemetry_events": [{"event": "grammar_raw_output", "input": "محمد صلاح لاعب كرة قدم مصري", "output": "محمد صلاح لاعب كرة قدم مصري"}]} |
| {"sample_id": "E002", "dataset": "entities", "input": "عبدالله يدرس في الجامعة", "expected": "عبدالله يدرس في الجامعة", "pipeline_output": "عبد الله يدرس في الجامعة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 689, "punctuation_ms": 450, "spelling_ms": 503, "total_ms": 1644}, "telemetry_events": [{"event": "grammar_raw_output", "input": "عبد الله يدرس في الجامعة", "output": "عبد الله يدرس في الجامعة"}]} |
| {"sample_id": "E003", "dataset": "entities", "input": "عبد الرحمن أخي الأكبر", "expected": "عبد الرحمن أخي الأكبر", "pipeline_output": "عبد الرحمن أخي الأكبر", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 580, "punctuation_ms": 411, "spelling_ms": 541, "total_ms": 1534}, "telemetry_events": [{"event": "grammar_raw_output", "input": "عبد الرحمن أخي الأكبر", "output": "عبد الرحمن أخي الأكبر"}]} |
| {"sample_id": "E004", "dataset": "entities", "input": "أحمد محمود يعمل مهندساً", "expected": "أحمد محمود يعمل مهندساً", "pipeline_output": "أحمد محمود يعمل مهندساً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 730, "punctuation_ms": 430, "spelling_ms": 1666, "total_ms": 2829}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أحمد محمود يعمل مهندساً", "output": "أحمد محمود يعمل مهندسا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "مهندسا", "end": 23, "event": "grammar_diff", "original": "مهندساً", "start": 16}, {"correction": "مهندسا", "event": "filter_reject", "filter": "TanweenGuard", "original": "مهندساً"}]} |
| {"sample_id": "E005", "dataset": "entities", "input": "الدكتور حسن علي أستاذ جامعي", "expected": "الدكتور حسن علي أستاذ جامعي", "pipeline_output": "الدكتور حسن علي أستاذ جامعي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 594, "punctuation_ms": 381, "spelling_ms": 2250, "total_ms": 3226}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الدكتور حسن علي أستاذ جامعي", "output": "الدكتور حسن علي أستاذ جامعي"}]} |
| {"sample_id": "E006", "dataset": "entities", "input": "السيدة فاطمة الزهراء معلمة", "expected": "السيدة فاطمة الزهراء معلمة", "pipeline_output": "السيدة فاطمة الزهراء معلمة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 487, "punctuation_ms": 629, "spelling_ms": 2520, "total_ms": 3637}, "telemetry_events": [{"event": "grammar_raw_output", "input": "السيدة فاطمة الزهراء معلمة", "output": "السيدة فاطمة الزهراء معلمة"}]} |
| {"sample_id": "E007", "dataset": "entities", "input": "الأستاذ عمر بن الخطاب عادل", "expected": "الأستاذ عمر بن الخطاب عادل", "pipeline_output": "الأستاذ عمر بن الخطاب عادل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 687, "punctuation_ms": 790, "spelling_ms": 2198, "total_ms": 3677}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الأستاذ عمر بن الخطاب عادل", "output": "الأستاذ عمر بن الخطاب عادل"}]} |
| {"sample_id": "E008", "dataset": "entities", "input": "خالد بن الوليد قائد عظيم", "expected": "خالد بن الوليد قائد عظيم", "pipeline_output": "خالد بن الوليد قائد عظيم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 686, "punctuation_ms": 479, "spelling_ms": 2516, "total_ms": 3682}, "telemetry_events": [{"event": "grammar_raw_output", "input": "خالد بن الوليد قائد عظيم", "output": "خالد بن الوليد قائد عظيم"}]} |
| {"sample_id": "E009", "dataset": "entities", "input": "صلاح الدين الأيوبي حرر القدس", "expected": "صلاح الدين الأيوبي حرر القدس", "pipeline_output": "صلاح الدين الأيوبي حرر القدس", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 641, "punctuation_ms": 592, "spelling_ms": 2674, "total_ms": 3909}, "telemetry_events": [{"event": "grammar_raw_output", "input": "صلاح الدين الأيوبي حرر القدس", "output": "صلاح الدين الأيوبي حرر القدس"}]} |
| {"sample_id": "E010", "dataset": "entities", "input": "ابن سينا عالم عربي مشهور", "expected": "ابن سينا عالم عربي مشهور", "pipeline_output": "ابن سينا عالم عربي مشهور", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 640, "punctuation_ms": 534, "spelling_ms": 2540, "total_ms": 3716}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ابن سينا عالم عربي مشهور", "output": "ابن سينا عالم عربي مشهور"}]} |
| {"sample_id": "E011", "dataset": "entities", "input": "جامعة القاهرة من أعرق الجامعات", "expected": "جامعة القاهرة من أعرق الجامعات", "pipeline_output": "جامعة القاهرة من أعرق الجامعات", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 694, "punctuation_ms": 641, "spelling_ms": 2717, "total_ms": 4054}, "telemetry_events": [{"event": "grammar_raw_output", "input": "جامعة القاهرة من أعرق الجامعات", "output": "جامعة القاهرة من أعرق الجامعات"}]} |
| {"sample_id": "E012", "dataset": "entities", "input": "مدينة الرياض عاصمة المملكة", "expected": "مدينة الرياض عاصمة المملكة", "pipeline_output": "مدينة الرياض عاصمة المملكة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 541, "punctuation_ms": 634, "spelling_ms": 2085, "total_ms": 3262}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مدينة الرياض عاصمة المملكة", "output": "مدينة الرياض عاصمة المملكة"}]} |
| {"sample_id": "E013", "dataset": "entities", "input": "دبي مدينة عصرية وجميلة", "expected": "دبي مدينة عصرية وجميلة", "pipeline_output": "دبي مدينة عصرية وجميلة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 595, "punctuation_ms": 530, "spelling_ms": 1709, "total_ms": 2835}, "telemetry_events": [{"event": "grammar_raw_output", "input": "دبي مدينة عصرية وجميلة", "output": "دبي مدينة عصرية وجميلة"}]} |
| {"sample_id": "E014", "dataset": "entities", "input": "القدس مدينة مقدسة عند المسلمين", "expected": "القدس مدينة مقدسة عند المسلمين", "pipeline_output": "القدس مدينة مقدسة عند المسلمين", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 602, "punctuation_ms": 714, "spelling_ms": 2240, "total_ms": 3557}, "telemetry_events": [{"event": "grammar_raw_output", "input": "القدس مدينة مقدسة عند المسلمين", "output": "القدس مدينة مقدسة عند المسلمين"}]} |
| {"sample_id": "E015", "dataset": "entities", "input": "مكة المكرمة أطهر البقاع", "expected": "مكة المكرمة أطهر البقاع", "pipeline_output": "مكة المكرمة أطهر البقاع", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 633, "punctuation_ms": 533, "spelling_ms": 2803, "total_ms": 3970}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مكة المكرمة أطهر البقاع", "output": "مكة المكرمة أطهر البقاع"}]} |
| {"sample_id": "E016", "dataset": "entities", "input": "المدينة المنورة طابة الطيبة", "expected": "المدينة المنورة طابة الطيبة", "pipeline_output": "المدينة المنورة طابة طيبة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 594, "punctuation_ms": 504, "spelling_ms": 2040, "total_ms": 3141}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المدينة المنورة طابة الطيبة", "output": "المدينة المنورة طابة طيبة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "طيبة", "end": 27, "event": "grammar_diff", "original": "الطيبة", "start": 21}, {"correction": "طيبة", "end": 27, "event": "patch_accepted", "original": "الطيبة", "stage": "grammar", "start": 21}]} |
| {"sample_id": "E017", "dataset": "entities", "input": "بغداد عاصمة العراق", "expected": "بغداد عاصمة العراق", "pipeline_output": "بغداد عاصمة العراق", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 430, "punctuation_ms": 451, "spelling_ms": 1660, "total_ms": 2543}, "telemetry_events": [{"event": "grammar_raw_output", "input": "بغداد عاصمة العراق", "output": "بغداد عاصمة العراق"}]} |
| {"sample_id": "E018", "dataset": "entities", "input": "دمشق أقدم عاصمة في التاريخ", "expected": "دمشق أقدم عاصمة في التاريخ", "pipeline_output": "دمشق أقدم عاصمة في التاريخ", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 582, "punctuation_ms": 417, "spelling_ms": 3417, "total_ms": 4418}, "telemetry_events": [{"event": "grammar_raw_output", "input": "دمشق أقدم عاصمة في التاريخ", "output": "دمشق أقدم عاصمة في التاريخ"}]} |
| {"sample_id": "E019", "dataset": "entities", "input": "شركة OpenAI تطور الذكاء الاصطناعي", "expected": "شركة OpenAI تطور الذكاء الاصطناعي", "pipeline_output": "شركة OpenAI تطور الذكاء الاصطناعي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 684, "punctuation_ms": 576, "spelling_ms": 0, "total_ms": 1261}, "telemetry_events": [{"event": "grammar_raw_output", "input": "شركة OpenAI تطور الذكاء الاصطناعي", "output": "شركة OpenAI تطور الذكاء الاصطناعي"}]} |
| {"sample_id": "E020", "dataset": "entities", "input": "شركة Google عملاق التقنية", "expected": "شركة Google عملاق التقنية", "pipeline_output": "شركة Google عملاق التقنية", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 483, "punctuation_ms": 402, "spelling_ms": 0, "total_ms": 886}, "telemetry_events": [{"event": "grammar_raw_output", "input": "شركة Google عملاق التقنية", "output": "شركة Google عملاق التقنية"}]} |
| {"sample_id": "E021", "dataset": "entities", "input": "شركة Microsoft تنتج البرمجيات", "expected": "شركة Microsoft تنتج البرمجيات", "pipeline_output": "شركة Microsoft تنتج البرمجيات", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 536, "punctuation_ms": 468, "spelling_ms": 0, "total_ms": 1006}, "telemetry_events": [{"event": "grammar_raw_output", "input": "شركة Microsoft تنتج البرمجيات", "output": "شركة Microsoft تنتج البرمجيات"}]} |
| {"sample_id": "E022", "dataset": "entities", "input": "منصة GitHub للمطورين", "expected": "منصة GitHub للمطورين", "pipeline_output": "منصة GitHub للمطورين", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 976, "punctuation_ms": 585, "spelling_ms": 0, "total_ms": 1562}, "telemetry_events": [{"event": "grammar_raw_output", "input": "منصة GitHub للمطورين", "output": "منصة GitHuب للمطورين"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "GitHuب", "end": 11, "event": "grammar_diff", "original": "GitHub", "start": 5}, {"correction": "GitHuب", "event": "filter_reject", "filter": "LatinGuard", "original": "GitHub"}]} |
| {"sample_id": "E023", "dataset": "entities", "input": "شركة Tesla للسيارات الكهربائية", "expected": "شركة Tesla للسيارات الكهربائية", "pipeline_output": "شركة Tesla للسيارات الكهربائية", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 686, "punctuation_ms": 663, "spelling_ms": 0, "total_ms": 1350}, "telemetry_events": [{"event": "grammar_raw_output", "input": "شركة Tesla للسيارات الكهربائية", "output": "شركة Teسla للسيارات الكهربائية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "Teسla", "end": 10, "event": "grammar_diff", "original": "Tesla", "start": 5}, {"correction": "Teسla", "event": "filter_reject", "filter": "LatinGuard", "original": "Tesla"}]} |
| {"sample_id": "E024", "dataset": "entities", "input": "أستخدم Python في البرمجة", "expected": "أستخدم Python في البرمجة", "pipeline_output": "أستخدمت Python في البرمجة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 582, "punctuation_ms": 636, "spelling_ms": 0, "total_ms": 1220}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أستخدم Python في البرمجة", "output": "أستخدمت Python في البرمجة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "أستخدمت", "end": 6, "event": "grammar_diff", "original": "أستخدم", "start": 0}, {"correction": "أستخدمت", "end": 6, "event": "patch_accepted", "original": "أستخدم", "stage": "grammar", "start": 0}]} |
| {"sample_id": "E025", "dataset": "entities", "input": "إطار TensorFlow مفيد للتعلم", "expected": "إطار TensorFlow مفيد للتعلم", "pipeline_output": "إطار TensorFlow مفيد للتعلم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 728, "punctuation_ms": 759, "spelling_ms": 0, "total_ms": 1489}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إطار TensorFlow مفيد للتعلم", "output": "إطار TensorFlow مفيد للتعلم"}]} |
| {"sample_id": "E026", "dataset": "entities", "input": "مكتبة PyTorch للتعلم العميق", "expected": "مكتبة PyTorch للتعلم العميق", "pipeline_output": "مكتبة PyTorch للتعلم العميق", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 678, "punctuation_ms": 719, "spelling_ms": 0, "total_ms": 1398}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مكتبة PyTorch للتعلم العميق", "output": "مكتبة PyTorch للتعلم العميق"}]} |
| {"sample_id": "E027", "dataset": "entities", "input": "منصة Node.js للخوادم", "expected": "منصة Node.js للخوادم", "pipeline_output": "منصة Node.js للخوادم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 931, "punctuation_ms": 578, "spelling_ms": 0, "total_ms": 1511}, "telemetry_events": [{"event": "grammar_raw_output", "input": "منصة Node.js للخوادم", "output": "منصة Node ، jة للخوادم"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "Node ، jة", "end": 12, "event": "grammar_diff", "original": "Node.js", "start": 5}, {"correction": "Node ، jة", "event": "filter_reject", "filter": "LatinGuard", "original": "Node.js"}]} |
| {"sample_id": "E028", "dataset": "entities", "input": "لغة JavaScript للويب", "expected": "لغة JavaScript للويب", "pipeline_output": "لغة JavaScript للويب", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 585, "punctuation_ms": 535, "spelling_ms": 0, "total_ms": 1121}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لغة JavaScript للويب", "output": "لغة JavaScript للويب"}]} |
| {"sample_id": "E029", "dataset": "entities", "input": "قاعدة بيانات MongoDB جيدة", "expected": "قاعدة بيانات MongoDB جيدة", "pipeline_output": "قاعدة بيانات MongoDB جيدة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 687, "punctuation_ms": 502, "spelling_ms": 0, "total_ms": 1190}, "telemetry_events": [{"event": "grammar_raw_output", "input": "قاعدة بيانات MongoDB جيدة", "output": "قاعدة بيانات MongoDB جيدة"}]} |
| {"sample_id": "E030", "dataset": "entities", "input": "خدمة Docker للحاويات", "expected": "خدمة Docker للحاويات", "pipeline_output": "خدمة Docker للحاويات", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 680, "punctuation_ms": 512, "spelling_ms": 0, "total_ms": 1193}, "telemetry_events": [{"event": "grammar_raw_output", "input": "خدمة Docker للحاويات", "output": "خدمة Docker للحاويات"}]} |
| {"sample_id": "G001", "dataset": "grammar", "input": "البنات ذهب إلى المدرسة", "expected": "البنات ذهب إلى المدرسة", "pipeline_output": "البنات ذهبن إلى المدرسة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 582, "punctuation_ms": 552, "spelling_ms": 1614, "total_ms": 2750}, "telemetry_events": [{"event": "grammar_raw_output", "input": "البنات ذهب إلى المدرسة", "output": "البنات ذهبن إلى المدرسة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "ذهبن", "end": 10, "event": "grammar_diff", "original": "ذهب", "start": 7}, {"correction": "ذهبن", "end": 10, "event": "patch_accepted", "original": "ذهب", "stage": "grammar", "start": 7}]} |
| {"sample_id": "G002", "dataset": "grammar", "input": "الطلاب يذهب إلى الجامعة", "expected": "الطلاب يذهب إلى الجامعة", "pipeline_output": "الطلاب يذهبون إلى الجامعة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 637, "punctuation_ms": 411, "spelling_ms": 1442, "total_ms": 2493}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الطلاب يذهب إلى الجامعة", "output": "الطلاب يذهبون إلى الجامعة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يذهبون", "end": 11, "event": "grammar_diff", "original": "يذهب", "start": 7}, {"correction": "يذهبون", "end": 11, "event": "patch_accepted", "original": "يذهب", "stage": "grammar", "start": 7}]} |
| {"sample_id": "G003", "dataset": "grammar", "input": "المهندسون حضر الاجتماع", "expected": "المهندسون حضر الاجتماع", "pipeline_output": "المهندسون حضرون الاجتماع", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 477, "punctuation_ms": 621, "spelling_ms": 1609, "total_ms": 2709}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المهندسون حضر الاجتماع", "output": "المهندسون حضرون الاجتماع"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "حضرون", "end": 13, "event": "grammar_diff", "original": "حضر", "start": 10}, {"correction": "حضرون", "end": 13, "event": "patch_accepted", "original": "حضر", "stage": "grammar", "start": 10}]} |
| {"sample_id": "G004", "dataset": "grammar", "input": "الرجال يعمل في المصنع", "expected": "الرجال يعمل في المصنع", "pipeline_output": "الرجال يعملون في المصنع", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 581, "punctuation_ms": 604, "spelling_ms": 1672, "total_ms": 2860}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الرجال يعمل في المصنع", "output": "الرجال يعملون في المصنع"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يعملون", "end": 11, "event": "grammar_diff", "original": "يعمل", "start": 7}, {"correction": "يعملون", "end": 11, "event": "patch_accepted", "original": "يعمل", "stage": "grammar", "start": 7}]} |
| {"sample_id": "G005", "dataset": "grammar", "input": "النساء ذهب إلى السوق", "expected": "النساء ذهب إلى السوق", "pipeline_output": "النساء ذهبن إلى السوق", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 591, "punctuation_ms": 491, "spelling_ms": 1821, "total_ms": 2904}, "telemetry_events": [{"event": "grammar_raw_output", "input": "النساء ذهب إلى السوق", "output": "النساء ذهبن إلى السوق"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "ذهبن", "end": 10, "event": "grammar_diff", "original": "ذهب", "start": 7}, {"correction": "ذهبن", "end": 10, "event": "patch_accepted", "original": "ذهب", "stage": "grammar", "start": 7}]} |
| {"sample_id": "G006", "dataset": "grammar", "input": "الأولاد لعب في الحديقة", "expected": "الأولاد لعب في الحديقة", "pipeline_output": "الأولاد لعب في الحديقة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 584, "punctuation_ms": 538, "spelling_ms": 1588, "total_ms": 2712}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الأولاد لعب في الحديقة", "output": "الأولاد لعبوَ في الحديقة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "لعبوَ", "end": 11, "event": "grammar_diff", "original": "لعب", "start": 8}, {"correction": "لعبوَ", "event": "filter_reject", "filter": "IVtoOOV", "original": "لعب"}]} |
| {"sample_id": "G007", "dataset": "grammar", "input": "المعلمات حضر الاجتماع", "expected": "المعلمات حضر الاجتماع", "pipeline_output": "المعلمات حضرن الاجتماع", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 481, "punctuation_ms": 566, "spelling_ms": 2051, "total_ms": 3100}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المعلمات حضر الاجتماع", "output": "المعلمات حضرن الاجتماع"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "حضرن", "end": 12, "event": "grammar_diff", "original": "حضر", "start": 9}, {"correction": "حضرن", "end": 12, "event": "patch_accepted", "original": "حضر", "stage": "grammar", "start": 9}]} |
| {"sample_id": "G008", "dataset": "grammar", "input": "الأطباء يعالج المرضى", "expected": "الأطباء يعالج المرضى", "pipeline_output": "الأطباء يعالجون المرضى", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 528, "punctuation_ms": 489, "spelling_ms": 1257, "total_ms": 2276}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الأطباء يعالج المرضى", "output": "الأطباء يعالجون المرضى"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يعالجون", "end": 13, "event": "grammar_diff", "original": "يعالج", "start": 8}, {"correction": "يعالجون", "end": 13, "event": "patch_accepted", "original": "يعالج", "stage": "grammar", "start": 8}]} |
| {"sample_id": "G009", "dataset": "grammar", "input": "العمال بنى المبنى", "expected": "العمال بنى المبنى", "pipeline_output": "العمال بنى المبنى", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 484, "punctuation_ms": 436, "spelling_ms": 1767, "total_ms": 2689}, "telemetry_events": [{"event": "grammar_raw_output", "input": "العمال بنى المبنى", "output": "العمال بنى المبنى"}]} |
| {"sample_id": "G010", "dataset": "grammar", "input": "الطالبات كتب الواجب", "expected": "الطالبات كتب الواجب", "pipeline_output": "الطالبات كتبن الواجب", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 433, "punctuation_ms": 477, "spelling_ms": 3352, "total_ms": 4264}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الطالبات كتب الواجب", "output": "الطالبات كتبن الواجب"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "كتبن", "end": 12, "event": "grammar_diff", "original": "كتب", "start": 9}, {"correction": "كتبن", "end": 12, "event": "patch_accepted", "original": "كتب", "stage": "grammar", "start": 9}]} |
| {"sample_id": "G011", "dataset": "grammar", "input": "السيارة جميل جداً", "expected": "السيارة جميل جداً", "pipeline_output": "السيارة جميلة جداً", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 734, "punctuation_ms": 426, "spelling_ms": 1543, "total_ms": 2705}, "telemetry_events": [{"event": "grammar_raw_output", "input": "السيارة جميل جداً", "output": "السيارة جميلة جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جميلة جدا", "end": 17, "event": "grammar_diff", "original": "جميل جداً", "start": 8}, {"correction": "جميلة جداً", "end": 17, "event": "patch_accepted", "original": "جميل جداً", "stage": "grammar", "start": 8}]} |
| {"sample_id": "G012", "dataset": "grammar", "input": "البنت ذكي في المدرسة", "expected": "البنت ذكي في المدرسة", "pipeline_output": "البنت ذكية في المدرسة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 588, "punctuation_ms": 645, "spelling_ms": 1642, "total_ms": 2877}, "telemetry_events": [{"event": "grammar_raw_output", "input": "البنت ذكي في المدرسة", "output": "البنت ذكية في المدرسة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "ذكية", "end": 9, "event": "grammar_diff", "original": "ذكي", "start": 6}, {"correction": "ذكية", "end": 9, "event": "patch_accepted", "original": "ذكي", "stage": "grammar", "start": 6}]} |
| {"sample_id": "G013", "dataset": "grammar", "input": "الطالبة متفوق في دراسته", "expected": "الطالبة متفوق في دراسته", "pipeline_output": "الطالب متفوق في دراسته", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 642, "punctuation_ms": 402, "spelling_ms": 1768, "total_ms": 2815}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الطالبة متفوق في دراسته", "output": "الطالب متفوق في دراسته"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الطالب", "end": 7, "event": "grammar_diff", "original": "الطالبة", "start": 0}, {"correction": "الطالب", "end": 7, "event": "patch_accepted", "original": "الطالبة", "stage": "grammar", "start": 0}]} |
| {"sample_id": "G014", "dataset": "grammar", "input": "المدينة كبير وواسع", "expected": "المدينة كبير وواسع", "pipeline_output": "المدينة كبيرة وواسعة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 643, "punctuation_ms": 695, "spelling_ms": 1955, "total_ms": 3296}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المدينة كبير وواسع", "output": "المدينة كبيرة وواسعة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "كبيرة وواسعة", "end": 18, "event": "grammar_diff", "original": "كبير وواسع", "start": 8}, {"correction": "كبيرة وواسعة", "end": 18, "event": "patch_accepted", "original": "كبير وواسع", "stage": "grammar", "start": 8}]} |
| {"sample_id": "G015", "dataset": "grammar", "input": "الشمس مشرق اليوم", "expected": "الشمس مشرق اليوم", "pipeline_output": "الشمس مشرقة اليوم", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 531, "punctuation_ms": 448, "spelling_ms": 1398, "total_ms": 2380}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الشمس مشرق اليوم", "output": "الشمس مشرقة اليوم"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "مشرقة", "end": 10, "event": "grammar_diff", "original": "مشرق", "start": 6}, {"correction": "مشرقة", "end": 10, "event": "patch_accepted", "original": "مشرق", "stage": "grammar", "start": 6}]} |
| {"sample_id": "G016", "dataset": "grammar", "input": "في المهندسون الماهرون", "expected": "في المهندسون الماهرون", "pipeline_output": "في المهندسين الماه رون", "passed": false, "suggestion_count": 2, "timing": {"grammar_ms": 778, "punctuation_ms": 521, "spelling_ms": 1676, "total_ms": 2977}, "telemetry_events": [{"event": "grammar_raw_output", "input": "في المهندسون الماه رون", "output": "في المهندسين الماه رون"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المهندسين", "end": 12, "event": "grammar_diff", "original": "المهندسون", "start": 3}, {"correction": "المهندسين", "end": 12, "event": "patch_accepted", "original": "المهندسون", "stage": "grammar", "start": 3}]} |
| {"sample_id": "G017", "dataset": "grammar", "input": "من المعلمون الأكفاء", "expected": "من المعلمون الأكفاء", "pipeline_output": "من المعلمين الأكفاء", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 577, "punctuation_ms": 431, "spelling_ms": 1955, "total_ms": 2968}, "telemetry_events": [{"event": "grammar_raw_output", "input": "من المعلمون الأكفاء", "output": "من المعلمين الأكفاء"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المعلمين", "end": 11, "event": "grammar_diff", "original": "المعلمون", "start": 3}, {"correction": "المعلمين", "end": 11, "event": "patch_accepted", "original": "المعلمون", "stage": "grammar", "start": 3}]} |
| {"sample_id": "G018", "dataset": "grammar", "input": "إلى المسافرون في المطار", "expected": "إلى المسافرون في المطار", "pipeline_output": "إلى المسافرين في المطار", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 629, "punctuation_ms": 426, "spelling_ms": 3249, "total_ms": 4306}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إلى المسافرون في المطار", "output": "إلى المسافرين في المطار"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المسافرين", "end": 13, "event": "grammar_diff", "original": "المسافرون", "start": 4}, {"correction": "المسافرين", "end": 13, "event": "patch_accepted", "original": "المسافرون", "stage": "grammar", "start": 4}]} |
| {"sample_id": "G019", "dataset": "grammar", "input": "على العاملون في المصنع", "expected": "على العاملون في المصنع", "pipeline_output": "على العاملين في المصنع", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 537, "punctuation_ms": 501, "spelling_ms": 1644, "total_ms": 2683}, "telemetry_events": [{"event": "grammar_raw_output", "input": "على العاملون في المصنع", "output": "على العاملين في المصنع"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "العاملين", "end": 12, "event": "grammar_diff", "original": "العاملون", "start": 4}, {"correction": "العاملين", "end": 12, "event": "patch_accepted", "original": "العاملون", "stage": "grammar", "start": 4}]} |
| {"sample_id": "G020", "dataset": "grammar", "input": "عن المهندسون في الشركة", "expected": "عن المهندسون في الشركة", "pipeline_output": "عن المهندسين في الشركة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 578, "punctuation_ms": 552, "spelling_ms": 1588, "total_ms": 2720}, "telemetry_events": [{"event": "grammar_raw_output", "input": "عن المهندسون في الشركة", "output": "عن المهندسين في الشركة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المهندسين", "end": 12, "event": "grammar_diff", "original": "المهندسون", "start": 3}, {"correction": "المهندسين", "end": 12, "event": "patch_accepted", "original": "المهندسون", "stage": "grammar", "start": 3}]} |
| {"sample_id": "G021", "dataset": "grammar", "input": "إن أبوك رجل طيب جداً", "expected": "إن أبوك رجل طيب جداً", "pipeline_output": "إن أباك رجل طيب جداً", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 789, "punctuation_ms": 409, "spelling_ms": 3009, "total_ms": 4209}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إن أبوك رجل طيب جداً", "output": "إن أباك رجل طيب جدا"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "أباك", "end": 7, "event": "grammar_diff", "original": "أبوك", "start": 3}, {"correction": "أباك", "end": 7, "event": "patch_accepted", "original": "أبوك", "stage": "grammar", "start": 3}, {"correction": "جدا", "end": 20, "event": "grammar_diff", "original": "جداً", "start": 16}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]} |
| {"sample_id": "G022", "dataset": "grammar", "input": "رأيت أخوك في المسجد", "expected": "رأيت أخوك في المسجد", "pipeline_output": "رأيت أخوك في المسجد", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 629, "punctuation_ms": 527, "spelling_ms": 2347, "total_ms": 3504}, "telemetry_events": [{"event": "grammar_raw_output", "input": "رأيت أخوك في المسجد", "output": "رأيت أخوك في المسجد"}]} |
| {"sample_id": "G023", "dataset": "grammar", "input": "في أبوك خير كثير", "expected": "في أبوك خير كثير", "pipeline_output": "في أبيك خير كثير", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 534, "punctuation_ms": 322, "spelling_ms": 3046, "total_ms": 3904}, "telemetry_events": [{"event": "grammar_raw_output", "input": "في أبوك خير كثير", "output": "في أبيك خير كثير"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "أبيك", "end": 7, "event": "grammar_diff", "original": "أبوك", "start": 3}, {"correction": "أبيك", "end": 7, "event": "patch_accepted", "original": "أبوك", "stage": "grammar", "start": 3}]} |
| {"sample_id": "G024", "dataset": "grammar", "input": "على أخوك أن يحضر", "expected": "على أخوك أن يحضر", "pipeline_output": "على أخيك أن يحضر", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 538, "punctuation_ms": 344, "spelling_ms": 3880, "total_ms": 4765}, "telemetry_events": [{"event": "grammar_raw_output", "input": "على أخوك أن يحضر", "output": "على أخيك أن يحضر"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "أخيك", "end": 8, "event": "grammar_diff", "original": "أخوك", "start": 4}, {"correction": "أخيك", "end": 8, "event": "patch_accepted", "original": "أخوك", "stage": "grammar", "start": 4}]} |
| {"sample_id": "G025", "dataset": "grammar", "input": "هذان الطالبتان مجتهدتان", "expected": "هذان الطالبتان مجتهدتان", "pipeline_output": "هاتان الطالبتان مجتهدتان", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 674, "punctuation_ms": 436, "spelling_ms": 2766, "total_ms": 3879}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هذان الطالبتان مجتهدتان", "output": "هاتان الطالبتان مجتهدتان"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "هاتان", "end": 4, "event": "grammar_diff", "original": "هذان", "start": 0}, {"correction": "هاتان", "end": 4, "event": "patch_accepted", "original": "هذان", "stage": "grammar", "start": 0}]} |
| {"sample_id": "G026", "dataset": "grammar", "input": "هاتان الطالبان مجتهدان", "expected": "هاتان الطالبان مجتهدان", "pipeline_output": "هذان الطالبان مجتهدان", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 676, "punctuation_ms": 371, "spelling_ms": 2451, "total_ms": 3500}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هاتان الطالبان مجتهدان", "output": "هذان الطالبان مجتهدان"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "هذان", "end": 5, "event": "grammar_diff", "original": "هاتان", "start": 0}, {"correction": "هذان", "end": 5, "event": "patch_accepted", "original": "هاتان", "stage": "grammar", "start": 0}]} |
| {"sample_id": "G027", "dataset": "grammar", "input": "لن يذهبون إلى المدرسة", "expected": "لن يذهبون إلى المدرسة", "pipeline_output": "لن يذهبوا إلى المدرسة", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 681, "punctuation_ms": 451, "spelling_ms": 1375, "total_ms": 2510}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لن يذهبون إلى المدرسة", "output": "لن يذهبوا إلى المدرسة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يذهبوا", "end": 9, "event": "grammar_diff", "original": "يذهبون", "start": 3}, {"correction": "يذهبوا", "end": 9, "event": "patch_accepted", "original": "يذهبون", "stage": "grammar", "start": 3}]} |
| {"sample_id": "G028", "dataset": "grammar", "input": "لم يفعلون الواجب بعد", "expected": "لم يفعلون الواجب بعد", "pipeline_output": "لم يفعلون الواجب بعد", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 683, "punctuation_ms": 419, "spelling_ms": 1482, "total_ms": 2586}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لم يفعلون الواجب بعد", "output": "لم يفعلوَ الواجب بعد"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يفعلوَ", "end": 9, "event": "grammar_diff", "original": "يفعلون", "start": 3}, {"correction": "يفعلوَ", "event": "filter_reject", "filter": "IVtoOOV", "original": "يفعلون"}]} |
| {"sample_id": "G029", "dataset": "grammar", "input": "كي يتعلمون الدرس", "expected": "كي يتعلمون الدرس", "pipeline_output": "كي يتعلم الدرس", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 428, "punctuation_ms": 345, "spelling_ms": 1211, "total_ms": 1987}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كي يتعلمون الدرس", "output": "كي يتعلم الدرس"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يتعلم", "end": 10, "event": "grammar_diff", "original": "يتعلمون", "start": 3}, {"correction": "يتعلم", "end": 10, "event": "patch_accepted", "original": "يتعلمون", "stage": "grammar", "start": 3}]} |
| {"sample_id": "G030", "dataset": "grammar", "input": "حتى يعملون بجد", "expected": "حتى يعملون بجد", "pipeline_output": "حتى يعملوا بجد", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 580, "punctuation_ms": 322, "spelling_ms": 1502, "total_ms": 2405}, "telemetry_events": [{"event": "grammar_raw_output", "input": "حتى يعملون بجد", "output": "حتى يعملوا بجد"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يعملوا", "end": 10, "event": "grammar_diff", "original": "يعملون", "start": 4}, {"correction": "يعملوا", "end": 10, "event": "patch_accepted", "original": "يعملون", "stage": "grammar", "start": 4}]} |
| {"sample_id": "G031", "dataset": "grammar", "input": "ذهب الطالب إلى المدرسة", "expected": "ذهب الطالب إلى المدرسة", "pipeline_output": "ذهب الطالب إلى المدرسة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 533, "punctuation_ms": 428, "spelling_ms": 1491, "total_ms": 2454}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهب الطالب إلى المدرسة", "output": "ذهب الطالب إلى المدرسة"}]} |
| {"sample_id": "G032", "dataset": "grammar", "input": "كتبت الطالبة المقال بنجاح", "expected": "كتبت الطالبة المقال بنجاح", "pipeline_output": "كتبت الطالبة المقال بنجاح", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 585, "punctuation_ms": 614, "spelling_ms": 1911, "total_ms": 3112}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كتبت الطالبة المقال بنجاح", "output": "كتبت الطالبة المقال بنجاح"}]} |
| {"sample_id": "G033", "dataset": "grammar", "input": "المعلمون في المدرسة يعملون", "expected": "المعلمون في المدرسة يعملون", "pipeline_output": "المعلمون في المدرسة يعملون", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 577, "punctuation_ms": 690, "spelling_ms": 1553, "total_ms": 2821}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المعلمون في المدرسة يعملون", "output": "المعلمون في المدرسة يعملون"}]} |
| {"sample_id": "G034", "dataset": "grammar", "input": "أحب القراءة والكتابة كثيراً", "expected": "أحب القراءة والكتابة كثيراً", "pipeline_output": "أحب القراءة والكتابة كثيراً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 590, "punctuation_ms": 553, "spelling_ms": 1777, "total_ms": 2922}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أحب القراءة والكتابة كثيراً", "output": "أحب القراءة والكتابة كثيرا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "كثيرا", "end": 27, "event": "grammar_diff", "original": "كثيراً", "start": 21}, {"correction": "كثيرا", "event": "filter_reject", "filter": "TanweenGuard", "original": "كثيراً"}]} |
| {"sample_id": "G035", "dataset": "grammar", "input": "ذهبت البنات إلى المدرسة", "expected": "ذهبت البنات إلى المدرسة", "pipeline_output": "ذهبت البنات إلى المدرسة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 531, "punctuation_ms": 510, "spelling_ms": 1703, "total_ms": 2746}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت البنات إلى المدرسة", "output": "ذهبت البنات إلى المدرسة"}]} |
| {"sample_id": "G036", "dataset": "grammar", "input": "جاء المعلمون إلى الفصل", "expected": "جاء المعلمون إلى الفصل", "pipeline_output": "جاء المعلمون إلى الفصل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 579, "punctuation_ms": 441, "spelling_ms": 1459, "total_ms": 2481}, "telemetry_events": [{"event": "grammar_raw_output", "input": "جاء المعلمون إلى الفصل", "output": "جاء المعلمون إلى الفصل"}]} |
| {"sample_id": "G037", "dataset": "grammar", "input": "ذهب الرجل إلى عمله", "expected": "ذهب الرجل إلى عمله", "pipeline_output": "ذهب الرجل إلى عمله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 691, "punctuation_ms": 398, "spelling_ms": 2269, "total_ms": 3359}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهب الرجل إلى عمله", "output": "ذهب الرجل إلى عمله"}]} |
| {"sample_id": "G038", "dataset": "grammar", "input": "يدرس الطالب في مكتبته", "expected": "يدرس الطالب في مكتبته", "pipeline_output": "يدرس الطالب في مكتبته", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 580, "punctuation_ms": 402, "spelling_ms": 2827, "total_ms": 3810}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يدرس الطالب في مكتبته", "output": "يدرس الطالب في مكتبته"}]} |
| {"sample_id": "G039", "dataset": "grammar", "input": "تعمل المرأة في الشركة", "expected": "تعمل المرأة في الشركة", "pipeline_output": "تعمل المرأة في الشركة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 531, "punctuation_ms": 410, "spelling_ms": 1482, "total_ms": 2424}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تعمل المرأة في الشركة", "output": "تعمل المرأة في الشركة"}]} |
| {"sample_id": "G040", "dataset": "grammar", "input": "نحن نجتهد في العمل", "expected": "نحن نجتهد في العمل", "pipeline_output": "نحن نجتهد في العمل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 680, "punctuation_ms": 370, "spelling_ms": 2591, "total_ms": 3643}, "telemetry_events": [{"event": "grammar_raw_output", "input": "نحن نجتهد في العمل", "output": "نحن نجتهد في العمل"}]} |
| {"sample_id": "G041", "dataset": "grammar", "input": "هم يسافرون كل صيف", "expected": "هم يسافرون كل صيف", "pipeline_output": "هم يسافرون كل صيف", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 732, "punctuation_ms": 365, "spelling_ms": 2181, "total_ms": 3280}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هم يسافرون كل صيف", "output": "هم يسافرون كل صيف"}]} |
| {"sample_id": "G042", "dataset": "grammar", "input": "الأطفال يلعبون في الحديقة", "expected": "الأطفال يلعبون في الحديقة", "pipeline_output": "الأطفال يلعبون في الحديقة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 631, "punctuation_ms": 508, "spelling_ms": 1308, "total_ms": 2449}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الأطفال يلعبون في الحديقة", "output": "الأطفال يلعبون في الحديقة"}]} |
| {"sample_id": "G043", "dataset": "grammar", "input": "إن العلم نافع للإنسان", "expected": "إن العلم نافع للإنسان", "pipeline_output": "إن العلم نافع للإنسين", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 481, "punctuation_ms": 481, "spelling_ms": 1458, "total_ms": 2421}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إن العلم نافع للإنسان", "output": "إن العلم نافع للإنسين"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "للإنسين", "end": 21, "event": "grammar_diff", "original": "للإنسان", "start": 14}, {"correction": "للإنسين", "end": 21, "event": "patch_accepted", "original": "للإنسان", "stage": "grammar", "start": 14}]} |
| {"sample_id": "G044", "dataset": "grammar", "input": "كان المطر غزيراً أمس", "expected": "كان المطر غزيراً أمس", "pipeline_output": "كان المطر غزيراً أمس", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 785, "punctuation_ms": 387, "spelling_ms": 2286, "total_ms": 3460}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كان المطر غزيراً أمس", "output": "كان المطر غزيرا أمس"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "غزيرا", "end": 16, "event": "grammar_diff", "original": "غزيراً", "start": 10}, {"correction": "غزيرا", "event": "filter_reject", "filter": "TanweenGuard", "original": "غزيراً"}]} |
| {"sample_id": "G045", "dataset": "grammar", "input": "لم يحضر الطالب اليوم", "expected": "لم يحضر الطالب اليوم", "pipeline_output": "لم يحضر الطالب اليوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 680, "punctuation_ms": 387, "spelling_ms": 1453, "total_ms": 2521}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لم يحضر الطالب اليوم", "output": "لم يحضر الطالب اليوم"}]} |
| {"sample_id": "H001", "dataset": "hallucination", "input": "أعلن رئيس الوزراء عن خطة اقتصادية جديدة لتطوير البنية التحتية في البلاد.", "expected": "أعلن رئيس الوزراء عن خطة اقتصادية جديدة لتطوير البنية التحتية في البلاد.", "pipeline_output": "أعلن رئيس الوزراء عن خطة اقتصادية جديدة لتطوير البنية التحتية في البلاد.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1262, "punctuation_ms": 1072, "spelling_ms": 8434, "total_ms": 10770}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أعلن رئيس الوزراء عن خطة اقتصادية جديدة لتطوير البنية التحتية في البلاد.", "output": "أعلن رئيس الوزراء عن خطة اقتصادية جديدة لتطوير البنية التحتية في البلاد"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "البلاد", "end": 72, "event": "grammar_diff", "original": "البلاد.", "start": 65}, {"correction": "البلاد", "event": "filter_reject", "filter": "PunctuationGuard", "original": "البلاد."}]} |
| {"sample_id": "H002", "dataset": "hallucination", "input": "شهدت المنطقة تطورات ميدانية متسارعة خلال الأيام الماضية.", "expected": "شهدت المنطقة تطورات ميدانية متسارعة خلال الأيام الماضية.", "pipeline_output": "شهدت المنطقة تطورات ميدانية متسارعة خلال الأيام الماضية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1049, "punctuation_ms": 812, "spelling_ms": 4726, "total_ms": 6588}, "telemetry_events": [{"event": "grammar_raw_output", "input": "شهدت المنطقة تطورات ميدانية متسارعة خلال الأيام الماضية.", "output": "شهدت المنطقة تطورات ميدانية متسارعة خلال الأيام الماضية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الماضية", "end": 56, "event": "grammar_diff", "original": "الماضية.", "start": 48}, {"correction": "الماضية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الماضية."}]} |
| {"sample_id": "H003", "dataset": "hallucination", "input": "أكد وزير التعليم أن المناهج الدراسية ستشهد تحديثاً شاملاً.", "expected": "أكد وزير التعليم أن المناهج الدراسية ستشهد تحديثاً شاملاً.", "pipeline_output": "أكد وزير التعليم أن المناهج الدراسية ستشهد تحديثاً شاملاً.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1190, "punctuation_ms": 891, "spelling_ms": 7238, "total_ms": 9322}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أكد وزير التعليم أن المناهج الدراسية ستشهد تحديثاً شاملاً.", "output": "أكد وزير التعليم أن المناهج الدراسية ستشهد تحديثا شاملا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "تحديثا شاملا", "end": 58, "event": "grammar_diff", "original": "تحديثاً شاملاً.", "start": 43}, {"correction": "تحديثا شاملا", "event": "filter_reject", "filter": "PunctuationGuard", "original": "تحديثاً شاملاً."}]} |
| {"sample_id": "H004", "dataset": "hallucination", "input": "افتتح الرئيس مشروعاً جديداً للطاقة المتجددة في الصحراء الغربية.", "expected": "افتتح الرئيس مشروعاً جديداً للطاقة المتجددة في الصحراء الغربية.", "pipeline_output": "افتتح الرئيس مشروعاً جديداً للطاقة المتجددة في الصحراء الغربية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1239, "punctuation_ms": 1055, "spelling_ms": 9349, "total_ms": 11645}, "telemetry_events": [{"event": "grammar_raw_output", "input": "افتتح الرئيس مشروعاً جديداً للطاقة المتجددة في الصحراء الغربية.", "output": "افتتح الرئيس مشروعا جديدا للطاقة المتجددة في الصحراء الغربية"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "مشروعا جديدا", "end": 27, "event": "grammar_diff", "original": "مشروعاً جديداً", "start": 13}, {"correction": "مشروعا جديدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "مشروعاً جديداً"}, {"correction": "الغربية", "end": 63, "event": "grammar_diff", "original": "الغربية.", "start": 55}, {"correction": "الغربية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الغربية."}]} |
| {"sample_id": "H005", "dataset": "hallucination", "input": "حققت الصادرات المصرية نمواً بنسبة عشرة بالمئة خلال الربع الأول.", "expected": "حققت الصادرات المصرية نمواً بنسبة عشرة بالمئة خلال الربع الأول.", "pipeline_output": "حققت الصادرات المصرية نمواً بنسبة عشرة بالمئة خلال الربع الأول.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1206, "punctuation_ms": 1192, "spelling_ms": 9829, "total_ms": 12229}, "telemetry_events": [{"event": "grammar_raw_output", "input": "حققت الصادرات المصرية نمواً بنسبة عشرة بالمئة خلال الربع الأول.", "output": "حققت الصادرات المصرية نموا بنسبة عشرة بالمئة خلال الربع الأول"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "نموا", "end": 27, "event": "grammar_diff", "original": "نمواً", "start": 22}, {"correction": "نموا", "event": "filter_reject", "filter": "TanweenGuard", "original": "نمواً"}, {"correction": "الأول", "end": 63, "event": "grammar_diff", "original": "الأول.", "start": 57}, {"correction": "الأول", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الأول."}]} |
| {"sample_id": "H006", "dataset": "hallucination", "input": "تهدف هذه الدراسة إلى تحليل العوامل المؤثرة في جودة التعليم العالي.", "expected": "تهدف هذه الدراسة إلى تحليل العوامل المؤثرة في جودة التعليم العالي.", "pipeline_output": "تهدف هذه الدراسة إلى تحليل العوامل المؤثرة في جودة التعليم العالي.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1098, "punctuation_ms": 1168, "spelling_ms": 11567, "total_ms": 13836}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تهدف هذه الدراسة إلى تحليل العوامل المؤثرة في جودة التعليم العالي.", "output": "تهدف هذه الدراسة إلى تحليل العوامل المؤثرة في جودة التعليم العالي"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "العالي", "end": 66, "event": "grammar_diff", "original": "العالي.", "start": 59}, {"correction": "العالي", "event": "filter_reject", "filter": "PunctuationGuard", "original": "العالي."}]} |
| {"sample_id": "H007", "dataset": "hallucination", "input": "أشارت النتائج إلى وجود علاقة إيجابية بين المتغيرين المدروسين.", "expected": "أشارت النتائج إلى وجود علاقة إيجابية بين المتغيرين المدروسين.", "pipeline_output": "أشارت النتائج إلى وجود علاقة إيجابية بين المتغيرين المدروسين.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1305, "punctuation_ms": 1092, "spelling_ms": 6654, "total_ms": 9053}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أشارت النتائج إلى وجود علاقة إيجابية بين المتغيرين المدروسين.", "output": "أشارت النتائج إلى وجود علاقة إيجابية بين المتغيرين المدروسين"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المدروسين", "end": 61, "event": "grammar_diff", "original": "المدروسين.", "start": 51}, {"correction": "المدروسين", "event": "filter_reject", "filter": "PunctuationGuard", "original": "المدروسين."}]} |
| {"sample_id": "H008", "dataset": "hallucination", "input": "استخدم الباحثون المنهج الوصفي التحليلي لدراسة الظاهرة.", "expected": "استخدم الباحثون المنهج الوصفي التحليلي لدراسة الظاهرة.", "pipeline_output": "استخدم الباحثون المنهج الوصفي التحليلي لدراسة الظاهرة.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1068, "punctuation_ms": 1040, "spelling_ms": 7694, "total_ms": 9804}, "telemetry_events": [{"event": "grammar_raw_output", "input": "استخدم الباحثون المنهج الوصفي التحليلي لدراسة الظاهرة.", "output": "استخدم الباحثون المنهج الوصفي التحليلي لدراسة الظاهرة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الظاهرة", "end": 54, "event": "grammar_diff", "original": "الظاهرة.", "start": 46}, {"correction": "الظاهرة", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الظاهرة."}]} |
| {"sample_id": "H009", "dataset": "hallucination", "input": "تم جمع البيانات من خلال استبانة إلكترونية وزعت على العينة.", "expected": "تم جمع البيانات من خلال استبانة إلكترونية وزعت على العينة.", "pipeline_output": "تم جمع البيانات من خلال استبانة إلكترونية وزعت على العينة.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1302, "punctuation_ms": 916, "spelling_ms": 13212, "total_ms": 15432}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تم جمع البيانات من خلال استبانة إلكترونية وزعت على العينة.", "output": "تم جمع البيانات من خلال استبانة إلكترونية وزعت على العينة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "العينة", "end": 58, "event": "grammar_diff", "original": "العينة.", "start": 51}, {"correction": "العينة", "event": "filter_reject", "filter": "PunctuationGuard", "original": "العينة."}]} |
| {"sample_id": "H010", "dataset": "hallucination", "input": "يوصي الباحث بإجراء دراسات مستقبلية لتعميق الفهم.", "expected": "يوصي الباحث بإجراء دراسات مستقبلية لتعميق الفهم.", "pipeline_output": "يوصي الباحث بإجراء دراسات مستقبلية لتعميق الفهم.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1163, "punctuation_ms": 806, "spelling_ms": 4678, "total_ms": 6650}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يوصي الباحث بإجراء دراسات مستقبلية لتعميق الفهم.", "output": "يوصي الباحث بإجراء دراسات مستقبلية لتعميق الفهم"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الفهم", "end": 48, "event": "grammar_diff", "original": "الفهم.", "start": 42}, {"correction": "الفهم", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الفهم."}]} |
| {"sample_id": "H011", "dataset": "hallucination", "input": "يعتمد النظام على بنية خادم عميل مع واجهة برمجة تطبيقات.", "expected": "يعتمد النظام على بنية خادم عميل مع واجهة برمجة تطبيقات.", "pipeline_output": "يعتمد النظام على بنية خادم عميل مع واجهة برمجة تطبيقات.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1081, "punctuation_ms": 1187, "spelling_ms": 10267, "total_ms": 12536}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يعتمد النظام على بنية خادم عميل مع واجهة برمجة تطبيقات.", "output": "يعتمد النظام على بنية خادم عميل مع واجهة برمجة تطبيقات"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "تطبيقات", "end": 55, "event": "grammar_diff", "original": "تطبيقات.", "start": 47}, {"correction": "تطبيقات", "event": "filter_reject", "filter": "PunctuationGuard", "original": "تطبيقات."}]} |
| {"sample_id": "H012", "dataset": "hallucination", "input": "تم تطوير التطبيق باستخدام إطار عمل حديث للواجهة الأمامية.", "expected": "تم تطوير التطبيق باستخدام إطار عمل حديث للواجهة الأمامية.", "pipeline_output": "تم تطوير التطبيق باستخدام إطار عمل حديث للواجهة الأمامية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1194, "punctuation_ms": 1082, "spelling_ms": 13192, "total_ms": 15470}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تم تطوير التطبيق باستخدام إطار عمل حديث للواجهة الأمامية.", "output": "تم تطوير التطبيق باستخدام إطار عمل حديث للواجهة الأمامية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الأمامية", "end": 57, "event": "grammar_diff", "original": "الأمامية.", "start": 48}, {"correction": "الأمامية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الأمامية."}]} |
| {"sample_id": "H013", "dataset": "hallucination", "input": "يستخدم النظام خوارزمية التعلم العميق لمعالجة اللغة الطبيعية.", "expected": "يستخدم النظام خوارزمية التعلم العميق لمعالجة اللغة الطبيعية.", "pipeline_output": "يستخدم النظام خوارزمية التعلم العميق لمعالجة اللغة الطبيعية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 994, "punctuation_ms": 924, "spelling_ms": 8400, "total_ms": 10319}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يستخدم النظام خوارزمية التعلم العميق لمعالجة اللغة الطبيعية.", "output": "يستخدم النظام خوارزمية التعلم العميق لمعالجة اللغة الطبيعية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الطبيعية", "end": 60, "event": "grammar_diff", "original": "الطبيعية.", "start": 51}, {"correction": "الطبيعية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الطبيعية."}]} |
| {"sample_id": "H014", "dataset": "hallucination", "input": "وفقاً للمادة الخامسة من القانون المدني يحق للمتضرر المطالبة بالتعويض.", "expected": "وفقاً للمادة الخامسة من القانون المدني يحق للمتضرر المطالبة بالتعويض.", "pipeline_output": "وفقاً للمادة الخامسة من القانين المدنيون يحق للمتضرر المطالبة بالتعويض.", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 1450, "punctuation_ms": 1285, "spelling_ms": 12348, "total_ms": 15086}, "telemetry_events": [{"event": "grammar_raw_output", "input": "وفقاً للمادة الخامسة من القانون المدني يحق للمتضرر المطالبة بالتعويض.", "output": "وفقا للمادة الخامسة من القانين المدنيون يحق للمتضرر المطالبة بالتعويض"}, {"count": 3, "event": "grammar_diffs_extracted"}, {"correction": "وفقا", "end": 5, "event": "grammar_diff", "original": "وفقاً", "start": 0}, {"correction": "وفقا", "event": "filter_reject", "filter": "TanweenGuard", "original": "وفقاً"}, {"correction": "القانين المدنيون", "end": 38, "event": "grammar_diff", "original": "القانون المدني", "start": 24}, {"correction": "القانين المدنيون", "end": 38, "event": "patch_accepted", "original": "القانون المدني", "stage": "grammar", "start": 24}, {"correction": "بالتعويض", "end": 69, "event": "grammar_diff", "original": "بالتعويض.", "start": 60}, {"correction": "بالتعويض", "event": "filter_reject", "filter": "PunctuationGuard", "original": "بالتعويض."}]} |
| {"sample_id": "H015", "dataset": "hallucination", "input": "يلتزم الطرف الأول بتسليم البضاعة خلال ثلاثين يوماً من تاريخ التعاقد.", "expected": "يلتزم الطرف الأول بتسليم البضاعة خلال ثلاثين يوماً من تاريخ التعاقد.", "pipeline_output": "يلتزم الطرف الأول بتسليم البضاعة خلال ثلاثين يوماً من تاريخ التعاقد.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1194, "punctuation_ms": 962, "spelling_ms": 8748, "total_ms": 10906}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يلتزم الطرف الأول بتسليم البضاعة خلال ثلاثين يوماً من تاريخ التعاقد.", "output": "يلتزم الطرف الأول بتسليم البضاعة خلال ثلاثين يوما من تاريخ التعاقد"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "يوما", "end": 50, "event": "grammar_diff", "original": "يوماً", "start": 45}, {"correction": "يوما", "event": "filter_reject", "filter": "TanweenGuard", "original": "يوماً"}, {"correction": "التعاقد", "end": 68, "event": "grammar_diff", "original": "التعاقد.", "start": 60}, {"correction": "التعاقد", "event": "filter_reject", "filter": "PunctuationGuard", "original": "التعاقد."}]} |
| {"sample_id": "H016", "dataset": "hallucination", "input": "كانت الشمس تغرب خلف الجبال وتلون السماء بألوان الذهب والأرجوان.", "expected": "كانت الشمس تغرب خلف الجبال وتلون السماء بألوان الذهب والأرجوان.", "pipeline_output": "كانت الشمس تغرب خلف الجبال وتلون السماء بألوان الذهب والأرجوان.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1262, "punctuation_ms": 1069, "spelling_ms": 8018, "total_ms": 10351}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كانت الشمس تغرب خلف الجبال وتلون السماء بألوان الذهب والأرجوان.", "output": "كانت الشمس تغرب خلف الجبال وتلون السماء بألوان الذهب والأرجوان"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "والأرجوان", "end": 63, "event": "grammar_diff", "original": "والأرجوان.", "start": 53}, {"correction": "والأرجوان", "event": "filter_reject", "filter": "PunctuationGuard", "original": "والأرجوان."}]} |
| {"sample_id": "H017", "dataset": "hallucination", "input": "في تلك الليلة الهادئة كان صوت الأمواج يعزف لحناً حزيناً.", "expected": "في تلك الليلة الهادئة كان صوت الأمواج يعزف لحناً حزيناً.", "pipeline_output": "في تلك الليلة الهادئة كان صوت الأمواج يعزفون لحنَ حزيناً", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 1396, "punctuation_ms": 925, "spelling_ms": 10271, "total_ms": 12599}, "telemetry_events": [{"event": "grammar_raw_output", "input": "في تلك الليلة الهادئة كان صوت الأمواج يعزف لحناً حزيناً.", "output": "في تلك الليلة الهادئة كان صوت الأمواج يعزفون لحنَ حزينا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "يعزفون لحنَ حزينا", "end": 56, "event": "grammar_diff", "original": "يعزف لحناً حزيناً.", "start": 38}, {"correction": "يعزفون لحنَ حزيناً", "end": 56, "event": "patch_accepted", "original": "يعزف لحناً حزيناً.", "stage": "grammar", "start": 38}]} |
| {"sample_id": "H018", "dataset": "hallucination", "input": "مضى الزمن سريعاً ولم يبق من الذكريات إلا ما حفظته القلوب.", "expected": "مضى الزمن سريعاً ولم يبق من الذكريات إلا ما حفظته القلوب.", "pipeline_output": "مضى الزمن سريعاً ولم يبق من الذكريات إلا ما حفظته القلوب.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1352, "punctuation_ms": 905, "spelling_ms": 10251, "total_ms": 12509}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مضى الزمن سريعاً ولم يبق من الذكريات إلا ما حفظته القلوب.", "output": "مضى الزمن سريعا ولم يبق من الذكريات إلا ما حفظته القلوب"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "سريعا", "end": 16, "event": "grammar_diff", "original": "سريعاً", "start": 10}, {"correction": "سريعا", "event": "filter_reject", "filter": "TanweenGuard", "original": "سريعاً"}, {"correction": "القلوب", "end": 57, "event": "grammar_diff", "original": "القلوب.", "start": 50}, {"correction": "القلوب", "event": "filter_reject", "filter": "PunctuationGuard", "original": "القلوب."}]} |
| {"sample_id": "H019", "dataset": "hallucination", "input": "الطالب يدرس في المكتبة.", "expected": "الطالب يدرس في المكتبة.", "pipeline_output": "الطالب يدرس في المكتبة.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 679, "punctuation_ms": 448, "spelling_ms": 3704, "total_ms": 4832}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الطالب يدرس في المكتبة.", "output": "الطالب يدرس في المكتبة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المكتبة", "end": 23, "event": "grammar_diff", "original": "المكتبة.", "start": 15}, {"correction": "المكتبة", "event": "filter_reject", "filter": "PunctuationGuard", "original": "المكتبة."}]} |
| {"sample_id": "H020", "dataset": "hallucination", "input": "ذهبت إلى السوق واشتريت خبزاً.", "expected": "ذهبت إلى السوق واشتريت خبزاً.", "pipeline_output": "ذهبت إلى السوق واشتريت خبزاً.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1088, "punctuation_ms": 715, "spelling_ms": 4110, "total_ms": 5916}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى السوق واشتريت خبزاً.", "output": "ذهبت إلى السوق واشتريت خبزا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "خبزا", "end": 29, "event": "grammar_diff", "original": "خبزاً.", "start": 23}, {"correction": "خبزا", "event": "filter_reject", "filter": "PunctuationGuard", "original": "خبزاً."}]} |
| {"sample_id": "H021", "dataset": "hallucination", "input": "المعلم يشرح الدرس بوضوح.", "expected": "المعلم يشرح الدرس بوضوح.", "pipeline_output": "المعلم يشرح الدرس بوضوح.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 585, "punctuation_ms": 451, "spelling_ms": 3803, "total_ms": 4841}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المعلم يشرح الدرس بوضوح.", "output": "المعلم يشرح الدرس بوضوح"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "بوضوح", "end": 24, "event": "grammar_diff", "original": "بوضوح.", "start": 18}, {"correction": "بوضوح", "event": "filter_reject", "filter": "PunctuationGuard", "original": "بوضوح."}]} |
| {"sample_id": "H022", "dataset": "hallucination", "input": "نحن نحب بلادنا ونعمل من أجلها.", "expected": "نحن نحب بلادنا ونعمل من أجلها.", "pipeline_output": "نحن نحب بلادنا ونعمل من أجلها.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 688, "punctuation_ms": 561, "spelling_ms": 3447, "total_ms": 4697}, "telemetry_events": [{"event": "grammar_raw_output", "input": "نحن نحب بلادنا ونعمل من أجلها.", "output": "نحن نحب بلادنا ونعمل من أجلها"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "أجلها", "end": 30, "event": "grammar_diff", "original": "أجلها.", "start": 24}, {"correction": "أجلها", "event": "filter_reject", "filter": "PunctuationGuard", "original": "أجلها."}]} |
| {"sample_id": "H023", "dataset": "hallucination", "input": "القراءة تنمي العقل وتوسع المدارك.", "expected": "القراءة تنمي العقل وتوسع المدارك.", "pipeline_output": "القراءة تنمي العقل وتوسع المدارك.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 853, "punctuation_ms": 778, "spelling_ms": 3697, "total_ms": 5329}, "telemetry_events": [{"event": "grammar_raw_output", "input": "القراءة تنمي العقل وتوسع المدارك.", "output": "القراءة تنمي العقل وتوسع المدارك"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المدارك", "end": 33, "event": "grammar_diff", "original": "المدارك.", "start": 25}, {"correction": "المدارك", "event": "filter_reject", "filter": "PunctuationGuard", "original": "المدارك."}]} |
| {"sample_id": "H024", "dataset": "hallucination", "input": "الماء ضروري للحياة والصحة.", "expected": "الماء ضروري للحياة والصحة.", "pipeline_output": "الماء ضروري للحياة والصحة.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 488, "punctuation_ms": 643, "spelling_ms": 3309, "total_ms": 4441}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الماء ضروري للحياة والصحة.", "output": "الماء ضروري للحياة والصحة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "والصحة", "end": 26, "event": "grammar_diff", "original": "والصحة.", "start": 19}, {"correction": "والصحة", "event": "filter_reject", "filter": "PunctuationGuard", "original": "والصحة."}]} |
| {"sample_id": "H025", "dataset": "hallucination", "input": "يجب أن نحترم الكبير ونعطف على الصغير.", "expected": "يجب أن نحترم الكبير ونعطف على الصغير.", "pipeline_output": "يجب أن نحترم الكبير ونعطف على الصغير.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 939, "punctuation_ms": 677, "spelling_ms": 7072, "total_ms": 8689}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يجب أن نحترم الكبير ونعطف على الصغير.", "output": "يجب أن نحترم الكبير ونعطف على الصغير"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الصغير", "end": 37, "event": "grammar_diff", "original": "الصغير.", "start": 30}, {"correction": "الصغير", "event": "filter_reject", "filter": "PunctuationGuard", "original": "الصغير."}]} |
| {"sample_id": "H026", "dataset": "hallucination", "input": "إن التعليم هو أساس تقدم الأمم، وبدونه لا يمكن تحقيق التنمية المستدامة.", "expected": "إن التعليم هو أساس تقدم الأمم، وبدونه لا يمكن تحقيق التنمية المستدامة.", "pipeline_output": "إن التعليم هو أساس تقدم الأمم، وبدونه لا يمكن تحقيق التنمية المستدامة.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1367, "punctuation_ms": 1137, "spelling_ms": 10122, "total_ms": 12628}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إن التعليم هو أساس تقدم الأمم، وبدونه لا يمكن تحقيق التنمية المستدامة.", "output": "إن التعليم هو أساس تقدم الأمم ، وبدونه لا يمكن تحقيق التنمية المستدامة"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "الأمم ،", "end": 30, "event": "grammar_diff", "original": "الأمم،", "start": 24}, {"correction": "المستدامة", "end": 70, "event": "grammar_diff", "original": "المستدامة.", "start": 60}, {"correction": "المستدامة", "event": "filter_reject", "filter": "PunctuationGuard", "original": "المستدامة."}]} |
| {"sample_id": "H027", "dataset": "hallucination", "input": "تسعى الحكومة إلى تطوير منظومة التعليم وتحسين جودة المخرجات التعليمية.", "expected": "تسعى الحكومة إلى تطوير منظومة التعليم وتحسين جودة المخرجات التعليمية.", "pipeline_output": "تسعى الحكومة إلى تطوير منظومة التعليم وتحسين جودة المخرجات التعليمية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1229, "punctuation_ms": 1234, "spelling_ms": 9201, "total_ms": 11666}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تسعى الحكومة إلى تطوير منظومة التعليم وتحسين جودة المخرجات التعليمية.", "output": "تسعى الحكومة إلى تطوير منظومة التعليم وتحسين جودة المخرجات التعليمية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "التعليمية", "end": 69, "event": "grammar_diff", "original": "التعليمية.", "start": 59}, {"correction": "التعليمية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "التعليمية."}]} |
| {"sample_id": "H028", "dataset": "hallucination", "input": "أثبتت الدراسات العلمية أن ممارسة الرياضة بانتظام تحسن الصحة النفسية والجسدية.", "expected": "أثبتت الدراسات العلمية أن ممارسة الرياضة بانتظام تحسن الصحة النفسية والجسدية.", "pipeline_output": "أثبتت الدراسات العلمية أن ممارسة الرياضة بانتظام تحسن الصحة النفسية والجسدية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1373, "punctuation_ms": 1619, "spelling_ms": 11623, "total_ms": 14617}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أثبتت الدراسات العلمية أن ممارسة الرياضة بانتظام تحسن الصحة النفسية والجسدية.", "output": "أثبتت الدراسات العلمية أن ممارسة الرياضة بانتظام تحسن الصحة النفسية والجسدية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "والجسدية", "end": 77, "event": "grammar_diff", "original": "والجسدية.", "start": 68}, {"correction": "والجسدية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "والجسدية."}]} |
| {"sample_id": "H029", "dataset": "hallucination", "input": "يعد الذكاء الاصطناعي من أهم التقنيات الحديثة التي ستغير مستقبل البشرية.", "expected": "يعد الذكاء الاصطناعي من أهم التقنيات الحديثة التي ستغير مستقبل البشرية.", "pipeline_output": "يعد الذكاء الاصطناعي من أهم التقنيات الحديثة التي ستغير مستقبل البشرية.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1149, "punctuation_ms": 1147, "spelling_ms": 11771, "total_ms": 14069}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يعد الذكاء الاصطناعي من أهم التقنيات الحديثة التي ستغير مستقبل البشرية.", "output": "يعد الذكاء الاصطناعي من أهم التقنيات الحديثة التي ستغير مستقبل البشرية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "البشرية", "end": 71, "event": "grammar_diff", "original": "البشرية.", "start": 63}, {"correction": "البشرية", "event": "filter_reject", "filter": "PunctuationGuard", "original": "البشرية."}]} |
| {"sample_id": "H030", "dataset": "hallucination", "input": "تلعب وسائل التواصل الاجتماعي دوراً مهماً في تشكيل الرأي العام المعاصر.", "expected": "تلعب وسائل التواصل الاجتماعي دوراً مهماً في تشكيل الرأي العام المعاصر.", "pipeline_output": "تلعب وسائل التواصل الاجتماعي دوراً مهماً في تشكيل الرأي العام المعاصر.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1467, "punctuation_ms": 1014, "spelling_ms": 12974, "total_ms": 15456}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تلعب وسائل التواصل الاجتماعي دوراً مهماً في تشكيل الرأي العام المعاصر.", "output": "تلعب وسائل التواصل الاجتماعي دورا مهما في تشكيل الرأي العام المعاصر"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "دورا مهما", "end": 40, "event": "grammar_diff", "original": "دوراً مهماً", "start": 29}, {"correction": "دورا مهما", "event": "filter_reject", "filter": "TanweenGuard", "original": "دوراً مهماً"}, {"correction": "المعاصر", "end": 70, "event": "grammar_diff", "original": "المعاصر.", "start": 62}, {"correction": "المعاصر", "event": "filter_reject", "filter": "PunctuationGuard", "original": "المعاصر."}]} |
| {"sample_id": "P001", "dataset": "punctuation", "input": "ذهبت إلى المدرسة ثم عدت إلى البيت", "expected": "ذهبت إلى المدرسة ثم عدت إلى البيت", "pipeline_output": "ذهبت إلى المدرسة ثم عدت إلى البيت", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 743, "punctuation_ms": 980, "spelling_ms": 3270, "total_ms": 4995}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى المدرسة ثم عدت إلى البيت", "output": "ذهبت إلى المدرسة ثم عدت إلى البيت"}]} |
| {"sample_id": "P002", "dataset": "punctuation", "input": "هل أنت بخير يا صديقي", "expected": "هل أنت بخير يا صديقي", "pipeline_output": "هل أنت بخير يا صديقي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 684, "punctuation_ms": 449, "spelling_ms": 3266, "total_ms": 4401}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هل أنت بخير يا صديقي", "output": "هل أنت بخير يا صديقي"}]} |
| {"sample_id": "P003", "dataset": "punctuation", "input": "مرحبا كيف حالك اليوم", "expected": "مرحبا كيف حالك اليوم", "pipeline_output": "مرحبا كيف حالك اليوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 732, "punctuation_ms": 425, "spelling_ms": 3192, "total_ms": 4352}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مرحبا كيف حالك اليوم", "output": "مرحبا كيف حالك اليوم"}]} |
| {"sample_id": "P004", "dataset": "punctuation", "input": "كيف حالك أنا بخير والحمد لله", "expected": "كيف حالك أنا بخير والحمد لله", "pipeline_output": "كيف حالك أنا بخير والحمد لله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "P005", "dataset": "punctuation", "input": "هذا الكتاب مفيد جداً وأنصح بقراءته", "expected": "هذا الكتاب مفيد جداً وأنصح بقراءته", "pipeline_output": "هذا الكتاب مفيد جداً وأنصح بقراءته", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1041, "punctuation_ms": 600, "spelling_ms": 4316, "total_ms": 5960}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هذا الكتاب مفيد جداً وأنصح بقراءته", "output": "هذا الكتاب مفيد جدا وأنصح بقراءته"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 20, "event": "grammar_diff", "original": "جداً", "start": 16}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]} |
| {"sample_id": "P006", "dataset": "punctuation", "input": "العلم نور والجهل ظلام والتعليم مهم", "expected": "العلم نور والجهل ظلام والتعليم مهم", "pipeline_output": "العلم نور والجهل ظلام والتعليم مهم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 805, "punctuation_ms": 743, "spelling_ms": 3324, "total_ms": 4874}, "telemetry_events": [{"event": "grammar_raw_output", "input": "العلم نور والجهل ظلام والتعليم مهم", "output": "العلم نور والجهل ظلام والتعليم مهم"}]} |
| {"sample_id": "P007", "dataset": "punctuation", "input": "ماذا تريد أن تفعل اليوم", "expected": "ماذا تريد أن تفعل اليوم", "pipeline_output": "ماذا تريد أن تفعل اليوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 733, "punctuation_ms": 387, "spelling_ms": 2219, "total_ms": 3340}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ماذا تريد أن تفعل اليوم", "output": "ماذا تريد أن تفعل اليوم"}]} |
| {"sample_id": "P008", "dataset": "punctuation", "input": "لماذا لم تحضر أمس", "expected": "لماذا لم تحضر أمس", "pipeline_output": "لماذا لم تحضر أمس", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 582, "punctuation_ms": 318, "spelling_ms": 2269, "total_ms": 3171}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لماذا لم تحضر أمس", "output": "لماذا لم تحضر أمس"}]} |
| {"sample_id": "P009", "dataset": "punctuation", "input": "جاء أحمد ومحمد وعلي", "expected": "جاء أحمد ومحمد وعلي", "pipeline_output": "جاء أحمد ومحمد وعلي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 532, "punctuation_ms": 535, "spelling_ms": 2018, "total_ms": 3087}, "telemetry_events": [{"event": "grammar_raw_output", "input": "جاء أحمد ومحمد وعلي", "output": "جاء أحمد ومحمد وعلي"}]} |
| {"sample_id": "P010", "dataset": "punctuation", "input": "ذهبت إلى السوق واشتريت خبزاً ولحماً ثم عدت", "expected": "ذهبت إلى السوق واشتريت خبزاً ولحماً ثم عدت", "pipeline_output": "ذهبت إلى السوق واشتريت خبزاً ولحماً ثم عدت", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1347, "punctuation_ms": 880, "spelling_ms": 6120, "total_ms": 8350}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى السوق واشتريت خبزاً ولحماً ثم عدت", "output": "ذهبت إلى السوق واشتريت خبزا ولحما ثم عدت"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "خبزا ولحما", "end": 35, "event": "grammar_diff", "original": "خبزاً ولحماً", "start": 23}, {"correction": "خبزا ولحما", "event": "filter_reject", "filter": "TanweenGuard", "original": "خبزاً ولحماً"}]} |
| {"sample_id": "P011", "dataset": "punctuation", "input": "ذهبت إلى المدرسة. ثم عدت.", "expected": "ذهبت إلى المدرسة. ثم عدت.", "pipeline_output": "ذهبت إلى المدرسة ، ثم عدت.", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 735, "punctuation_ms": 590, "spelling_ms": 6655, "total_ms": 7982}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى المدرسة. ثم عدت.", "output": "ذهبت إلى المدرسة ، ثم عدت"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "المدرسة ،", "end": 17, "event": "grammar_diff", "original": "المدرسة.", "start": 9}, {"correction": "المدرسة ،", "end": 17, "event": "patch_accepted", "original": "المدرسة.", "stage": "grammar", "start": 9}, {"correction": "عدت", "end": 25, "event": "grammar_diff", "original": "عدت.", "start": 21}, {"correction": "عدت", "event": "filter_reject", "filter": "PunctuationGuard", "original": "عدت."}]} |
| {"sample_id": "P012", "dataset": "punctuation", "input": "كيف حالك؟ أنا بخير.", "expected": "كيف حالك؟ أنا بخير.", "pipeline_output": "كيف حالك؟ أنا بخير.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 735, "punctuation_ms": 415, "spelling_ms": 3752, "total_ms": 4904}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كيف حالك؟ أنا بخير.", "output": "كيف حالك ؟ أنا بخير"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "حالك ؟", "end": 9, "event": "grammar_diff", "original": "حالك؟", "start": 4}, {"correction": "بخير", "end": 19, "event": "grammar_diff", "original": "بخير.", "start": 14}, {"correction": "بخير", "event": "filter_reject", "filter": "PunctuationGuard", "original": "بخير."}]} |
| {"sample_id": "P013", "dataset": "punctuation", "input": "أحمد، كيف حالك؟ هل أنت بخير؟", "expected": "أحمد، كيف حالك؟ هل أنت بخير؟", "pipeline_output": "أحمد، كيف حالك؟ هل أنت بخير؟", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1031, "punctuation_ms": 535, "spelling_ms": 6899, "total_ms": 8467}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أحمد، كيف حالك؟ هل أنت بخير؟", "output": "أحمد ، كيف حالك ؟ هل أنت بخير ؟"}, {"count": 3, "event": "grammar_diffs_extracted"}, {"correction": "أحمد ،", "end": 5, "event": "grammar_diff", "original": "أحمد،", "start": 0}, {"correction": "حالك ؟", "end": 15, "event": "grammar_diff", "original": "حالك؟", "start": 10}, {"correction": "بخير ؟", "end": 28, "event": "grammar_diff", "original": "بخير؟", "start": 23}]} |
| {"sample_id": "P014", "dataset": "punctuation", "input": "قال: أنا بخير، شكراً لك.", "expected": "قال: أنا بخير، شكراً لك.", "pipeline_output": "قال: أنا بخير ، شكرا لكً", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 891, "punctuation_ms": 534, "spelling_ms": 5018, "total_ms": 6446}, "telemetry_events": [{"event": "grammar_raw_output", "input": "قال: أنا بخير، شكراً لك.", "output": "قال : أنا بخير ، شكرا لك"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "قال :", "end": 4, "event": "grammar_diff", "original": "قال:", "start": 0}, {"correction": "بخير ، شكرا لك", "end": 24, "event": "grammar_diff", "original": "بخير، شكراً لك.", "start": 9}, {"correction": "بخير ، شكرا لكً", "end": 24, "event": "patch_accepted", "original": "بخير، شكراً لك.", "stage": "grammar", "start": 9}]} |
| {"sample_id": "P015", "dataset": "punctuation", "input": "ذهبت إلى المكتبة، واشتريت كتاباً.", "expected": "ذهبت إلى المكتبة، واشتريت كتاباً.", "pipeline_output": "ذهبت إلى المكتبة، واشتريت كتاباً.", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 988, "punctuation_ms": 731, "spelling_ms": 5682, "total_ms": 7402}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى المكتبة، واشتريت كتاباً.", "output": "ذهبت إلى المكتبة ، واشتريت كتابا"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "المكتبة ،", "end": 17, "event": "grammar_diff", "original": "المكتبة،", "start": 9}, {"correction": "كتابا", "end": 33, "event": "grammar_diff", "original": "كتاباً.", "start": 26}, {"correction": "كتابا", "event": "filter_reject", "filter": "PunctuationGuard", "original": "كتاباً."}]} |
| {"sample_id": "P016", "dataset": "punctuation", "input": "ذهبت الي المدرسه أمس", "expected": "ذهبت الي المدرسه أمس", "pipeline_output": "ذهبت إلى المدرسة أمس", "passed": false, "suggestion_count": 2, "timing": {"grammar_ms": 744, "punctuation_ms": 468, "spelling_ms": 2455, "total_ms": 3670}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى المدرسة أمس", "output": "ذهبت إلى المدرسة أمس"}]} |
| {"sample_id": "P017", "dataset": "punctuation", "input": "انا طالب في الجامعه", "expected": "انا طالب في الجامعه", "pipeline_output": "أنا طالب في الجامعة", "passed": false, "suggestion_count": 2, "timing": {"grammar_ms": 587, "punctuation_ms": 415, "spelling_ms": 4132, "total_ms": 5136}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أنا طالب في الجامعة", "output": "أنا طالب في الجامعة"}]} |
| {"sample_id": "P018", "dataset": "punctuation", "input": "قال أحمد أنا سعيد بلقائك يا صديقي", "expected": "قال أحمد أنا سعيد بلقائك يا صديقي", "pipeline_output": "قال أحمد أنا سعيد بلقائك يا صديقي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 785, "punctuation_ms": 640, "spelling_ms": 4525, "total_ms": 5952}, "telemetry_events": [{"event": "grammar_raw_output", "input": "قال أحمد أنا سعيد بلقائك يا صديقي", "output": "قال أحمد أنا سعيد بلقائك يا صديقي"}]} |
| {"sample_id": "P019", "dataset": "punctuation", "input": "أحتاج إلى خبز ولبن وجبن وبيض", "expected": "أحتاج إلى خبز ولبن وجبن وبيض", "pipeline_output": "أحتاج إلى خبز ولبن وجبن وبيض", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 995, "punctuation_ms": 628, "spelling_ms": 4203, "total_ms": 5828}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أحتاج إلى خبز ولبن وجبن وبيض", "output": "أحتاج إلى خبز ولبن وجبن وبيض"}]} |
| {"sample_id": "P020", "dataset": "punctuation", "input": "يا إلهي هذا رائع جداً", "expected": "يا إلهي هذا رائع جداً", "pipeline_output": "يا إلهي هذا رائع جداً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 684, "punctuation_ms": 538, "spelling_ms": 3014, "total_ms": 4238}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يا إلهي هذا رائع جداً", "output": "يا إلهي هذا رائع جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 21, "event": "grammar_diff", "original": "جداً", "start": 17}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]} |
| {"sample_id": "R001", "dataset": "religious", "input": "بسم الله الرحمن الرحيم", "expected": "بسم الله الرحمن الرحيم", "pipeline_output": "بسم الله الرحمن الرحيم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R002", "dataset": "religious", "input": "الحمد لله رب العالمين الرحمن الرحيم مالك يوم الدين", "expected": "الحمد لله رب العالمين الرحمن الرحيم مالك يوم الدين", "pipeline_output": "الحمد لله رب العالمين الرحمن الرحيم مالك يوم الدين", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R003", "dataset": "religious", "input": "إياك نعبد وإياك نستعين", "expected": "إياك نعبد وإياك نستعين", "pipeline_output": "إياك نعبد وإياك نستعين", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R004", "dataset": "religious", "input": "اهدنا الصراط المستقيم صراط الذين أنعمت عليهم", "expected": "اهدنا الصراط المستقيم صراط الذين أنعمت عليهم", "pipeline_output": "اهدنا الصراط المستقيم صراط الذين أنعمت عليهم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R005", "dataset": "religious", "input": "قل هو الله أحد الله الصمد لم يلد ولم يولد", "expected": "قل هو الله أحد الله الصمد لم يلد ولم يولد", "pipeline_output": "قل هو الله أحد الله الصمد لم يلد ولم يولد", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R006", "dataset": "religious", "input": "إنا أنزلناه في ليلة القدر", "expected": "إنا أنزلناه في ليلة القدر", "pipeline_output": "إنا أنزلناه في ليلة القدر", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R007", "dataset": "religious", "input": "قل أعوذ برب الفلق من شر ما خلق", "expected": "قل أعوذ برب الفلق من شر ما خلق", "pipeline_output": "قل أعوذ برب الفلق من شر ما خلق", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R008", "dataset": "religious", "input": "قل أعوذ برب الناس ملك الناس إله الناس", "expected": "قل أعوذ برب الناس ملك الناس إله الناس", "pipeline_output": "قل أعوذ برب الناس ملك الناس إله الناس", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R009", "dataset": "religious", "input": "ذلك الكتاب لا ريب فيه هدى للمتقين", "expected": "ذلك الكتاب لا ريب فيه هدى للمتقين", "pipeline_output": "ذلك الكتاب لا ريب فيه هدى للمتقين", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R010", "dataset": "religious", "input": "الذين يؤمنون بالغيب ويقيمون الصلاة", "expected": "الذين يؤمنون بالغيب ويقيمون الصلاة", "pipeline_output": "الذين يؤمنون بالغيب ويقيمون الصلاة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 732, "punctuation_ms": 666, "spelling_ms": 2581, "total_ms": 3980}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الذين يؤمنون بالغيب ويقيمون الصلاة", "output": "الذين يؤمنون بالغيب ويقيمون الصلاة"}]} |
| {"sample_id": "R011", "dataset": "religious", "input": "الله لا إله إلا هو الحي القيوم لا تأخذه سنة ولا نوم", "expected": "الله لا إله إلا هو الحي القيوم لا تأخذه سنة ولا نوم", "pipeline_output": "الله لا إله إلا هو الحي القيوم لا تأخذه سنة ولا نوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R012", "dataset": "religious", "input": "لا إله إلا الله محمد رسول الله", "expected": "لا إله إلا الله محمد رسول الله", "pipeline_output": "لا إله إلا الله محمد رسول الله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R013", "dataset": "religious", "input": "أشهد أن لا إله إلا الله وأشهد أن محمداً رسول الله", "expected": "أشهد أن لا إله إلا الله وأشهد أن محمداً رسول الله", "pipeline_output": "أشهد أن لا إله إلا الله وأشهد أن محمداً رسول الله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R014", "dataset": "religious", "input": "إنما الأعمال بالنيات وإنما لكل امرئ ما نوى", "expected": "إنما الأعمال بالنيات وإنما لكل امرئ ما نوى", "pipeline_output": "إنما الأعمال بالنيات وإنما لكل امرئ ما نوى", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R015", "dataset": "religious", "input": "خيركم من تعلم القرآن وعلمه", "expected": "خيركم من تعلم القرآن وعلمه", "pipeline_output": "خيركم من تعلم القرآن وعلمه", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 758, "punctuation_ms": 644, "spelling_ms": 3048, "total_ms": 4452}, "telemetry_events": [{"event": "grammar_raw_output", "input": "خيركم من تعلم القرآن وعلمه", "output": "خيركم من تعلم القرآن وعلمه"}]} |
| {"sample_id": "R016", "dataset": "religious", "input": "المسلم من سلم المسلمون من لسانه ويده", "expected": "المسلم من سلم المسلمون من لسانه ويده", "pipeline_output": "المسلم من سلم المسلمون من لسانه ويده", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R017", "dataset": "religious", "input": "لا يؤمن أحدكم حتى يحب لأخيه ما يحب لنفسه", "expected": "لا يؤمن أحدكم حتى يحب لأخيه ما يحب لنفسه", "pipeline_output": "لا يؤمن أحدكم حتى يحب لأخيه ما يحب لنفسه", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R018", "dataset": "religious", "input": "من كان يؤمن بالله واليوم الآخر فليقل خيراً أو ليصمت", "expected": "من كان يؤمن بالله واليوم الآخر فليقل خيراً أو ليصمت", "pipeline_output": "من كان يؤمن بالله واليوم الآخر فليقل خيراً أو ليصمت", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1163, "punctuation_ms": 1018, "spelling_ms": 8788, "total_ms": 10971}, "telemetry_events": [{"event": "grammar_raw_output", "input": "من كان يؤمن بالله واليوم الآخر فليقل خيراً أو ليصمت", "output": "من كان يؤمن بالله واليوم الآخر فليقل خيرا أو ليصمت"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "خيرا", "end": 42, "event": "grammar_diff", "original": "خيراً", "start": 37}, {"correction": "خيرا", "event": "filter_reject", "filter": "TanweenGuard", "original": "خيراً"}]} |
| {"sample_id": "R019", "dataset": "religious", "input": "ربنا آتنا في الدنيا حسنة وفي الآخرة حسنة وقنا عذاب النار", "expected": "ربنا آتنا في الدنيا حسنة وفي الآخرة حسنة وقنا عذاب النار", "pipeline_output": "ربنا آتنا في الدنيا حسنة وفي الآخرة حسنة وقنا عذاب النار", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R020", "dataset": "religious", "input": "رب اشرح لي صدري ويسر لي أمري", "expected": "رب اشرح لي صدري ويسر لي أمري", "pipeline_output": "رب اشرح لي صدري ويسر لي أمري", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R021", "dataset": "religious", "input": "حسبنا الله ونعم الوكيل", "expected": "حسبنا الله ونعم الوكيل", "pipeline_output": "حسبنا الله ونعم الوكيل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R022", "dataset": "religious", "input": "لا حول ولا قوة إلا بالله", "expected": "لا حول ولا قوة إلا بالله", "pipeline_output": "لا حول ولا قوة إلا بالله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R023", "dataset": "religious", "input": "الحمد لله رب العالمين", "expected": "الحمد لله رب العالمين", "pipeline_output": "الحمد لله رب العالمين", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R024", "dataset": "religious", "input": "سبحان الله وبحمده سبحان الله العظيم", "expected": "سبحان الله وبحمده سبحان الله العظيم", "pipeline_output": "سبحان الله وبحمده سبحان الله العظيم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R025", "dataset": "religious", "input": "اللهم صل وسلم على نبينا محمد", "expected": "اللهم صل وسلم على نبينا محمد", "pipeline_output": "اللهم صل وسلم على نبينا محمد", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R026", "dataset": "religious", "input": "أستغفر الله العظيم وأتوب إليه", "expected": "أستغفر الله العظيم وأتوب إليه", "pipeline_output": "أستغفر الله العظيم وأتوب إليه", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R027", "dataset": "religious", "input": "الله أكبر الله أكبر لا إله إلا الله", "expected": "الله أكبر الله أكبر لا إله إلا الله", "pipeline_output": "الله أكبر الله أكبر لا إله إلا الله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R028", "dataset": "religious", "input": "إنا لله وإنا إليه راجعون", "expected": "إنا لله وإنا إليه راجعون", "pipeline_output": "إنا لله وإنا إليه راجعون", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R029", "dataset": "religious", "input": "بسم الله والحمد لله", "expected": "بسم الله والحمد لله", "pipeline_output": "بسم الله والحمد لله", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "R030", "dataset": "religious", "input": "السلام عليكم ورحمة الله وبركاته", "expected": "السلام عليكم ورحمة الله وبركاته", "pipeline_output": "السلام عليكم ورحمة الله وبركاته", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 0, "punctuation_ms": 0, "spelling_ms": 0, "total_ms": 0}, "telemetry_events": []} |
| {"sample_id": "S001", "dataset": "spelling", "input": "انا طالب في الجامعة", "expected": "أنا طالب في الجامعة", "pipeline_output": "أنا طالب في الجامعة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 642, "punctuation_ms": 331, "spelling_ms": 1535, "total_ms": 2510}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أنا طالب في الجامعة", "output": "أنا طالب في الجامعة"}]} |
| {"sample_id": "S002", "dataset": "spelling", "input": "اذا جاء الربيع تزهر الأشجار", "expected": "إذا جاء الربيع تزهر الأشجار", "pipeline_output": "إذا جاء الربيع تزهر الأشجار", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 634, "punctuation_ms": 532, "spelling_ms": 3389, "total_ms": 4557}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إذا جاء الربيع تزهر الأشجار", "output": "إذا جاء الربيع تزهر الأشجار"}]} |
| {"sample_id": "S003", "dataset": "spelling", "input": "ايضا هذا الأمر مهم جداً", "expected": "أيضاً هذا الأمر مهم جداً", "pipeline_output": "ايضا هذا الأمر مهم جداً", "passed": false, "suggestion_count": 0, "timing": {"grammar_ms": 687, "punctuation_ms": 614, "spelling_ms": 3166, "total_ms": 4469}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ايضا هذا الأمر مهم جداً", "output": "ايضا هذا الأمر مهم جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 23, "event": "grammar_diff", "original": "جداً", "start": 19}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]} |
| {"sample_id": "S004", "dataset": "spelling", "input": "لان الأمر يتعلق بالمستقبل", "expected": "لأن الأمر يتعلق بالمستقبل", "pipeline_output": "لأن الأمر يتعلق بالمستقبل", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 533, "punctuation_ms": 517, "spelling_ms": 2949, "total_ms": 4002}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لأن الأمر يتعلق بالمستقبل", "output": "لأن الأمر يتعلق بالمستقبل"}]} |
| {"sample_id": "S005", "dataset": "spelling", "input": "اين ذهبت أمس", "expected": "أين ذهبت أمس", "pipeline_output": "أين ذهبت أمس", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 434, "punctuation_ms": 326, "spelling_ms": 1590, "total_ms": 2351}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أين ذهبت أمس", "output": "أين ذهبت أمس"}]} |
| {"sample_id": "S006", "dataset": "spelling", "input": "اول مرة أزور هذا المكان", "expected": "أول مرة أزور هذا المكان", "pipeline_output": "اول مرة أزور هذا المكان", "passed": false, "suggestion_count": 0, "timing": {"grammar_ms": 696, "punctuation_ms": 484, "spelling_ms": 3153, "total_ms": 4336}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اول مرة أزور هذا المكان", "output": "اول مرة أزور هذا المكان"}]} |
| {"sample_id": "S007", "dataset": "spelling", "input": "هذا او ذاك لا فرق", "expected": "هذا أو ذاك لا فرق", "pipeline_output": "هذا أو ذاك لا فرق", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 783, "punctuation_ms": 414, "spelling_ms": 3096, "total_ms": 4295}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هذا أو ذاك لا فرق", "output": "هذا أو ذاك لا فرق"}]} |
| {"sample_id": "S008", "dataset": "spelling", "input": "اكبر مدينة في العالم", "expected": "أكبر مدينة في العالم", "pipeline_output": "أكبر مدينة في العالم", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 541, "punctuation_ms": 377, "spelling_ms": 1859, "total_ms": 2780}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أكبر مدينة في العالم", "output": "أكبر مدينة في العالم"}]} |
| {"sample_id": "S009", "dataset": "spelling", "input": "اصغر طالب في الصف", "expected": "أصغر طالب في الصف", "pipeline_output": "أصغر طالب في الصف", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 587, "punctuation_ms": 432, "spelling_ms": 1807, "total_ms": 2827}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أصغر طالب في الصف", "output": "أصغر طالب في الصف"}]} |
| {"sample_id": "S010", "dataset": "spelling", "input": "ابناء الوطن يعملون بجد", "expected": "أبناء الوطن يعملون بجد", "pipeline_output": "أبناء الوطن يعملون بجد", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 631, "punctuation_ms": 420, "spelling_ms": 1563, "total_ms": 2617}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أبناء الوطن يعملون بجد", "output": "أبناء الوطن يعملون بجد"}]} |
| {"sample_id": "S011", "dataset": "spelling", "input": "اطفال المدرسة يلعبون", "expected": "أطفال المدرسة يلعبون", "pipeline_output": "أطفال المدرسة يلعبون", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 528, "punctuation_ms": 379, "spelling_ms": 1593, "total_ms": 2503}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أطفال المدرسة يلعبون", "output": "أطفال المدرسة يلعبون"}]} |
| {"sample_id": "S012", "dataset": "spelling", "input": "اخيراً وصلنا إلى الهدف", "expected": "أخيراً وصلنا إلى الهدف", "pipeline_output": "أخيراً وصلنا إلى الهدف", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 592, "punctuation_ms": 561, "spelling_ms": 3304, "total_ms": 4460}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اخيراً وصلنا إلى الهدف", "output": "أخيرا وصلنا إلى الهدف"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "أخيرا", "end": 6, "event": "grammar_diff", "original": "اخيراً", "start": 0}, {"correction": "أخيراً", "end": 6, "event": "patch_accepted", "original": "اخيراً", "stage": "spelling", "start": 0}]} |
| {"sample_id": "S013", "dataset": "spelling", "input": "وقف امام المدرسة", "expected": "وقف أمام المدرسة", "pipeline_output": "وقف أمام المدرسة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 448, "punctuation_ms": 364, "spelling_ms": 1410, "total_ms": 2225}, "telemetry_events": [{"event": "grammar_raw_output", "input": "وقف أمام المدرسة", "output": "وقف أمام المدرسة"}]} |
| {"sample_id": "S014", "dataset": "spelling", "input": "انت طالب مجتهد", "expected": "أنت طالب مجتهد", "pipeline_output": "أنت طالب مجتهد", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 533, "punctuation_ms": 276, "spelling_ms": 1525, "total_ms": 2336}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أنت طالب مجتهد", "output": "أنت طالب مجتهد"}]} |
| {"sample_id": "S015", "dataset": "spelling", "input": "اننا نحب الوطن", "expected": "إننا نحب الوطن", "pipeline_output": "اننا نحب الوطن", "passed": false, "suggestion_count": 0, "timing": {"grammar_ms": 480, "punctuation_ms": 398, "spelling_ms": 2145, "total_ms": 3025}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اننا نحب الوطن", "output": "اننا نحب الوطن"}]} |
| {"sample_id": "S016", "dataset": "spelling", "input": "ان شاء الله سنفوز", "expected": "إن شاء الله سنفوز", "pipeline_output": "إن شاء الله سنفوز", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 578, "punctuation_ms": 442, "spelling_ms": 2892, "total_ms": 3915}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ان شاء الله سنفوز", "output": "إن شاء الله سنفوز"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "إن", "end": 2, "event": "grammar_diff", "original": "ان", "start": 0}, {"correction": "إن", "end": 2, "event": "patch_accepted", "original": "ان", "stage": "spelling", "start": 0}]} |
| {"sample_id": "S017", "dataset": "spelling", "input": "اقترب الموعد النهائي", "expected": "اقترب الموعد النهائي", "pipeline_output": "اقترب الموعد النهائي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 532, "punctuation_ms": 396, "spelling_ms": 1503, "total_ms": 2433}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اقترب الموعد النهائي", "output": "اقترب الموعد النهائي"}]} |
| {"sample_id": "S018", "dataset": "spelling", "input": "ارسل الرسالة فوراً", "expected": "أرسل الرسالة فوراً", "pipeline_output": "أرسل الرسالة فوراً", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 583, "punctuation_ms": 387, "spelling_ms": 1583, "total_ms": 2555}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أرسل الرسالة فوراً", "output": "أرسلت الرسالة فورو"}, {"count": 2, "event": "grammar_diffs_extracted"}, {"correction": "أرسلت", "end": 4, "event": "grammar_diff", "original": "أرسل", "start": 0}, {"correction": "أرسلت", "event": "filter_reject", "filter": "StageLocker", "original": "أرسل"}, {"correction": "فورو", "end": 18, "event": "grammar_diff", "original": "فوراً", "start": 13}, {"correction": "فورو", "event": "filter_reject", "filter": "IVtoOOV", "original": "فوراً"}]} |
| {"sample_id": "S019", "dataset": "spelling", "input": "اخر الأخبار في المساء", "expected": "آخر الأخبار في المساء", "pipeline_output": "آخر الأخبار في المساء", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 530, "punctuation_ms": 486, "spelling_ms": 1609, "total_ms": 2628}, "telemetry_events": [{"event": "grammar_raw_output", "input": "آخر الأخبار في المساء", "output": "آخر الأخبار في المساء"}]} |
| {"sample_id": "S020", "dataset": "spelling", "input": "اسرع في المشي قليلاً", "expected": "أسرع في المشي قليلاً", "pipeline_output": "أسرع في المشي قليلاً", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 680, "punctuation_ms": 376, "spelling_ms": 2519, "total_ms": 3577}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أسرع في المشي قليلاً", "output": "أسرع في المشي قليلا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "قليلا", "end": 20, "event": "grammar_diff", "original": "قليلاً", "start": 14}, {"correction": "قليلا", "event": "filter_reject", "filter": "TanweenGuard", "original": "قليلاً"}]} |
| {"sample_id": "S021", "dataset": "spelling", "input": "اجمل مكان في العالم", "expected": "أجمل مكان في العالم", "pipeline_output": "أجمل مكان في العالم", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 535, "punctuation_ms": 367, "spelling_ms": 1762, "total_ms": 2666}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أجمل مكان في العالم", "output": "أجمل مكان في العالم"}]} |
| {"sample_id": "S022", "dataset": "spelling", "input": "اعلن الرئيس عن القرار", "expected": "أعلن الرئيس عن القرار", "pipeline_output": "اعلن الرئيس عن القرار", "passed": false, "suggestion_count": 0, "timing": {"grammar_ms": 539, "punctuation_ms": 440, "spelling_ms": 1575, "total_ms": 2556}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اعلن الرئيس عن القرار", "output": "اعلن الرئيس عن القرار"}]} |
| {"sample_id": "S023", "dataset": "spelling", "input": "اكد الوزير على الخطة", "expected": "أكد الوزير على الخطة", "pipeline_output": "أكد الوزير على الخطة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 531, "punctuation_ms": 417, "spelling_ms": 1621, "total_ms": 2572}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أكد الوزير على الخطة", "output": "أكد الوزير على الخطة"}]} |
| {"sample_id": "S024", "dataset": "spelling", "input": "اشار التقرير إلى ذلك", "expected": "أشار التقرير إلى ذلك", "pipeline_output": "أشار التقرير إلى ذلك", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 487, "punctuation_ms": 324, "spelling_ms": 2113, "total_ms": 2927}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أشار التقرير إلى ذلك", "output": "أشار التقرير إلى ذلك"}]} |
| {"sample_id": "S025", "dataset": "spelling", "input": "اعتقد انه سيحضر غداً", "expected": "أعتقد أنه سيحضر غداً", "pipeline_output": "أعتقد انه سيحضر غداً", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 633, "punctuation_ms": 438, "spelling_ms": 1563, "total_ms": 2637}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أعتقد انه سيحضر غداً", "output": "أعتقد انه سيحضر غدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "غدا", "end": 20, "event": "grammar_diff", "original": "غداً", "start": 16}, {"correction": "غدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "غداً"}]} |
| {"sample_id": "S026", "dataset": "spelling", "input": "والاسعار مرتفعة جداً", "expected": "والأسعار مرتفعة جداً", "pipeline_output": "والأسعار مرتفعة جداً", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 643, "punctuation_ms": 402, "spelling_ms": 1879, "total_ms": 2927}, "telemetry_events": [{"event": "grammar_raw_output", "input": "والأسعار مرتفعة جداً", "output": "والأسعار مرتفعة جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 20, "event": "grammar_diff", "original": "جداً", "start": 16}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]} |
| {"sample_id": "S027", "dataset": "spelling", "input": "بالاضافة إلى ذلك", "expected": "بالإضافة إلى ذلك", "pipeline_output": "بالإضافة إلى ذلك", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 484, "punctuation_ms": 346, "spelling_ms": 2164, "total_ms": 2996}, "telemetry_events": [{"event": "grammar_raw_output", "input": "بالاضافة إلى ذلك", "output": "بالإضافة إلى ذلك"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "بالإضافة", "end": 8, "event": "grammar_diff", "original": "بالاضافة", "start": 0}, {"correction": "بالإضافة", "end": 8, "event": "patch_accepted", "original": "بالاضافة", "stage": "spelling", "start": 0}]} |
| {"sample_id": "S028", "dataset": "spelling", "input": "فالانسان يحتاج للعلم", "expected": "فالإنسان يحتاج للعلم", "pipeline_output": "فالانسان يحتاج للعلم", "passed": false, "suggestion_count": 0, "timing": {"grammar_ms": 582, "punctuation_ms": 536, "spelling_ms": 3461, "total_ms": 4581}, "telemetry_events": [{"event": "grammar_raw_output", "input": "فالانسان يحتاج للعلم", "output": "فالانسان يحتاج للعلم"}]} |
| {"sample_id": "S029", "dataset": "spelling", "input": "كالاطفال في اللعب", "expected": "كالأطفال في اللعب", "pipeline_output": "كلا الأطفال في اللعب", "passed": false, "suggestion_count": 1, "timing": {"grammar_ms": 731, "punctuation_ms": 440, "spelling_ms": 3356, "total_ms": 4528}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كلا الأطفال في اللعب", "output": "كلا الأطفال في اللعب"}]} |
| {"sample_id": "S030", "dataset": "spelling", "input": "للاسف لم ينجح", "expected": "للأسف لم ينجح", "pipeline_output": "للأسف لم ينجح", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 478, "punctuation_ms": 445, "spelling_ms": 1906, "total_ms": 2831}, "telemetry_events": [{"event": "grammar_raw_output", "input": "للاسف لم ينجح", "output": "للأسف لم ينجح"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "للأسف", "end": 5, "event": "grammar_diff", "original": "للاسف", "start": 0}, {"correction": "للأسف", "end": 5, "event": "patch_accepted", "original": "للاسف", "stage": "spelling", "start": 0}]} |
| {"sample_id": "S031", "dataset": "spelling", "input": "المدرسه كبيره وجميله", "expected": "المدرسة كبيرة وجميلة", "pipeline_output": "المدرسة كبيرة وجميلة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 542, "punctuation_ms": 521, "spelling_ms": 1764, "total_ms": 2830}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المدرسة كبيرة وجميلة", "output": "المدرسة كبيرة وجميلة"}]} |
| {"sample_id": "S032", "dataset": "spelling", "input": "الجامعه في القاهره", "expected": "الجامعة في القاهرة", "pipeline_output": "الجامعة في القاهرة", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 537, "punctuation_ms": 474, "spelling_ms": 3601, "total_ms": 4615}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الجامعة في القاهرة", "output": "الجامعة في القاهرة"}]} |
| {"sample_id": "S033", "dataset": "spelling", "input": "السياره سريعه جداً", "expected": "السيارة سريعة جداً", "pipeline_output": "السيارة سريعة جداً", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 637, "punctuation_ms": 458, "spelling_ms": 2995, "total_ms": 4093}, "telemetry_events": [{"event": "grammar_raw_output", "input": "السيارة سريعة جداً", "output": "السيارة سريعة جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 18, "event": "grammar_diff", "original": "جداً", "start": 14}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]} |
| {"sample_id": "S034", "dataset": "spelling", "input": "الشجره طويله وجميله", "expected": "الشجرة طويلة وجميلة", "pipeline_output": "الشجرة طويلة وجميلة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 492, "punctuation_ms": 486, "spelling_ms": 1971, "total_ms": 2952}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الشجرة طويلة وجميلة", "output": "الشجرة طويلة وجميلة"}]} |
| {"sample_id": "S035", "dataset": "spelling", "input": "الحياه صعبه في المدينه", "expected": "الحياة صعبة في المدينة", "pipeline_output": "الحياة صعبة في المدينة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 686, "punctuation_ms": 556, "spelling_ms": 2381, "total_ms": 3631}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الحياه صعبة في المدينة", "output": "الحياة صعبة في المدينة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الحياة", "end": 6, "event": "grammar_diff", "original": "الحياه", "start": 0}, {"correction": "الحياة", "end": 6, "event": "patch_accepted", "original": "الحياه", "stage": "spelling", "start": 0}]} |
| {"sample_id": "S036", "dataset": "spelling", "input": "المكتبه قريبه من البيت", "expected": "المكتبة قريبة من البيت", "pipeline_output": "المكتبة قريبة من البيت", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 636, "punctuation_ms": 495, "spelling_ms": 3443, "total_ms": 4576}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المكتبة قريبة من البيت", "output": "المكتبة قريبة من البيت"}]} |
| {"sample_id": "S037", "dataset": "spelling", "input": "الغرفه نظيفه ومرتبه", "expected": "الغرفة نظيفة ومرتبة", "pipeline_output": "الغرفة نظيفة ومرتبة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 593, "punctuation_ms": 608, "spelling_ms": 3667, "total_ms": 4872}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الغرفة نظيفة ومرتبة", "output": "الغرفة نظيفة ومرتبة"}]} |
| {"sample_id": "S038", "dataset": "spelling", "input": "القصه مثيره للاهتمام", "expected": "القصة مثيرة للاهتمام", "pipeline_output": "القصة مثيرة للاهتمام", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 582, "punctuation_ms": 451, "spelling_ms": 2431, "total_ms": 3466}, "telemetry_events": [{"event": "grammar_raw_output", "input": "القصة مثيرة للاهتمام", "output": "القصة مثيرة للاهتمام"}]} |
| {"sample_id": "S039", "dataset": "spelling", "input": "الرحله طويله ومتعبه", "expected": "الرحلة طويلة ومتعبة", "pipeline_output": "الرحلة طويلة ومتعبة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 642, "punctuation_ms": 583, "spelling_ms": 2151, "total_ms": 3379}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الرحلة طويلة ومتعبة", "output": "الرحلة طويلة ومتعبة"}]} |
| {"sample_id": "S040", "dataset": "spelling", "input": "الوظيفه صعبه لكنها مفيده", "expected": "الوظيفة صعبة لكنها مفيدة", "pipeline_output": "الوظيفة صعبة لكنها مفيدة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 539, "punctuation_ms": 565, "spelling_ms": 2859, "total_ms": 3967}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الوظيفه صعبة لكنها مفيدة", "output": "الوظيفة صعبة لكنها مفيدة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الوظيفة", "end": 7, "event": "grammar_diff", "original": "الوظيفه", "start": 0}, {"correction": "الوظيفة", "end": 7, "event": "patch_accepted", "original": "الوظيفه", "stage": "spelling", "start": 0}]} |
| {"sample_id": "S041", "dataset": "spelling", "input": "بالمدرسه الكبيره", "expected": "بالمدرسة الكبيرة", "pipeline_output": "بالمدرسة الكبيرة", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 382, "punctuation_ms": 473, "spelling_ms": 3754, "total_ms": 4611}, "telemetry_events": [{"event": "grammar_raw_output", "input": "بالمدرسة الكبيرة", "output": "بالمدرسة الكبيرة"}]} |
| {"sample_id": "S042", "dataset": "spelling", "input": "والجامعه المصريه", "expected": "والجامعة المصرية", "pipeline_output": "والجامعة المصرية", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 490, "punctuation_ms": 398, "spelling_ms": 2364, "total_ms": 3255}, "telemetry_events": [{"event": "grammar_raw_output", "input": "والجامعة المصريه", "output": "والجامعة المصرية"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "المصرية", "end": 16, "event": "grammar_diff", "original": "المصريه", "start": 9}, {"correction": "المصرية", "end": 16, "event": "patch_accepted", "original": "المصريه", "stage": "spelling", "start": 9}]} |
| {"sample_id": "S043", "dataset": "spelling", "input": "فالسياره الجديده", "expected": "فالسيارة الجديدة", "pipeline_output": "فالسيارة الجديدة", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 429, "punctuation_ms": 514, "spelling_ms": 3404, "total_ms": 4350}, "telemetry_events": [{"event": "grammar_raw_output", "input": "فالسياره الجديدة", "output": "فالسيارة الجديدة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "فالسيارة", "end": 8, "event": "grammar_diff", "original": "فالسياره", "start": 0}, {"correction": "فالسيارة", "end": 8, "event": "patch_accepted", "original": "فالسياره", "stage": "spelling", "start": 0}]} |
| {"sample_id": "S044", "dataset": "spelling", "input": "كالمدرسه القديمه", "expected": "كالمدرسة القديمة", "pipeline_output": "كالمدرسة القديمة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 528, "punctuation_ms": 549, "spelling_ms": 2921, "total_ms": 4000}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كالمدرسه القديمه", "output": "كالمدرسة القديمة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "كالمدرسة القديمة", "end": 16, "event": "grammar_diff", "original": "كالمدرسه القديمه", "start": 0}, {"correction": "كالمدرسة القديمة", "end": 16, "event": "patch_accepted", "original": "كالمدرسه القديمه", "stage": "spelling", "start": 0}]} |
| {"sample_id": "S045", "dataset": "spelling", "input": "للمدرسه الابتدائيه", "expected": "للمدرسة الابتدائية", "pipeline_output": "للمدرسة الابتدائية", "passed": true, "suggestion_count": 2, "timing": {"grammar_ms": 349, "punctuation_ms": 547, "spelling_ms": 3247, "total_ms": 4147}, "telemetry_events": [{"event": "grammar_raw_output", "input": "للمدرسة الابتدائية", "output": "للمدرسة الابتدائية"}]} |
| {"sample_id": "S046", "dataset": "spelling", "input": "ذهبت الي المكتبة", "expected": "ذهبت إلى المكتبة", "pipeline_output": "ذهبت إلى المكتبة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 481, "punctuation_ms": 424, "spelling_ms": 1726, "total_ms": 2633}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى المكتبة", "output": "ذهبت إلى المكتبة"}]} |
| {"sample_id": "S047", "dataset": "spelling", "input": "المستشفي الكبير", "expected": "المستشفى الكبير", "pipeline_output": "المستشفى الكبير", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 328, "punctuation_ms": 383, "spelling_ms": 1189, "total_ms": 1903}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المستشفى الكبير", "output": "المستشفى الكبير"}]} |
| {"sample_id": "S048", "dataset": "spelling", "input": "هدي الطالبة ممتاز", "expected": "هدى الطالبة ممتاز", "pipeline_output": "هدى الطالبة ممتازة", "passed": false, "suggestion_count": 2, "timing": {"grammar_ms": 487, "punctuation_ms": 518, "spelling_ms": 1433, "total_ms": 2441}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هدى الطالبة ممتاز", "output": "هدى الطالبة ممتازة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "ممتازة", "end": 17, "event": "grammar_diff", "original": "ممتاز", "start": 12}, {"correction": "ممتازة", "end": 17, "event": "patch_accepted", "original": "ممتاز", "stage": "grammar", "start": 12}]} |
| {"sample_id": "S049", "dataset": "spelling", "input": "مصطفي طالب مجتهد", "expected": "مصطفى طالب مجتهد", "pipeline_output": "مصطفى طالب مجتهد", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 734, "punctuation_ms": 307, "spelling_ms": 1402, "total_ms": 2445}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مصطفى طالب مجتهد", "output": "مصطفى طالب مجتهد"}]} |
| {"sample_id": "S050", "dataset": "spelling", "input": "موسي نبي عظيم", "expected": "موسى نبي عظيم", "pipeline_output": "موسى نبي عظيم", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 481, "punctuation_ms": 281, "spelling_ms": 1618, "total_ms": 2382}, "telemetry_events": [{"event": "grammar_raw_output", "input": "موسى نبي عظيم", "output": "موسى نبي عظيم"}]} |
| {"sample_id": "S051", "dataset": "spelling", "input": "علي يدرس في الكلية", "expected": "علي يدرس في الكلية", "pipeline_output": "علي يدرس في الكلية", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 542, "punctuation_ms": 411, "spelling_ms": 1639, "total_ms": 2593}, "telemetry_events": [{"event": "grammar_raw_output", "input": "علي يدرس في الكلية", "output": "علي يدرس في الكلية"}]} |
| {"sample_id": "S052", "dataset": "spelling", "input": "ذهب الي السوق", "expected": "ذهب إلى السوق", "pipeline_output": "ذهب إلى السوق", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 432, "punctuation_ms": 324, "spelling_ms": 1804, "total_ms": 2563}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهب إلى السوق", "output": "ذهب إلى السوق"}]} |
| {"sample_id": "S053", "dataset": "spelling", "input": "بني المبنى الجديد", "expected": "بنى المبنى الجديد", "pipeline_output": "بنى المبنى الجديد", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 438, "punctuation_ms": 410, "spelling_ms": 1701, "total_ms": 2552}, "telemetry_events": [{"event": "grammar_raw_output", "input": "بنى المبنى الجديد", "output": "بنى المبنى الجديد"}]} |
| {"sample_id": "S054", "dataset": "spelling", "input": "ذهبت فيالبيت", "expected": "ذهبت في البيت", "pipeline_output": "ذهبت في البيت", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 484, "punctuation_ms": 390, "spelling_ms": 1501, "total_ms": 2377}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت في البيت", "output": "ذهبت في البيت"}]} |
| {"sample_id": "S055", "dataset": "spelling", "input": "خرج منالمدرسة", "expected": "خرج من المدرسة", "pipeline_output": "خرج من المدرسة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 433, "punctuation_ms": 471, "spelling_ms": 2338, "total_ms": 3245}, "telemetry_events": [{"event": "grammar_raw_output", "input": "خرج من المدرسة", "output": "خرج من المدرسة"}]} |
| {"sample_id": "S056", "dataset": "spelling", "input": "بقي عندالباب", "expected": "بقي عند الباب", "pipeline_output": "بقي عند الباب", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 437, "punctuation_ms": 338, "spelling_ms": 1355, "total_ms": 2131}, "telemetry_events": [{"event": "grammar_raw_output", "input": "بقي عند الباب", "output": "بقي عند الباب"}]} |
| {"sample_id": "S057", "dataset": "spelling", "input": "جلس عندالنافذة", "expected": "جلس عند النافذة", "pipeline_output": "جلس عند النافذة", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 532, "punctuation_ms": 433, "spelling_ms": 1373, "total_ms": 2339}, "telemetry_events": [{"event": "grammar_raw_output", "input": "جلس عند النافذة", "output": "جلس عند النافذة"}]} |
| {"sample_id": "S058", "dataset": "spelling", "input": "رجع الىالبيت", "expected": "رجع إلى البيت", "pipeline_output": "رجع إلى البيت", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 482, "punctuation_ms": 329, "spelling_ms": 2327, "total_ms": 3140}, "telemetry_events": [{"event": "grammar_raw_output", "input": "رجع إلى البيت", "output": "رجع إلى البيت"}]} |
| {"sample_id": "S059", "dataset": "spelling", "input": "خرج منالباب الخلفي", "expected": "خرج من الباب الخلفي", "pipeline_output": "خرج من الباب الخلفي", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 535, "punctuation_ms": 423, "spelling_ms": 1516, "total_ms": 2476}, "telemetry_events": [{"event": "grammar_raw_output", "input": "خرج من الباب الخلفي", "output": "خرج من الباب الخلفي"}]} |
| {"sample_id": "S060", "dataset": "spelling", "input": "نظر الىالسماء", "expected": "نظر إلى السماء", "pipeline_output": "نظر إلى السماء", "passed": true, "suggestion_count": 1, "timing": {"grammar_ms": 533, "punctuation_ms": 341, "spelling_ms": 1877, "total_ms": 2752}, "telemetry_events": [{"event": "grammar_raw_output", "input": "نظر إلى السماء", "output": "نظر إلى السماء"}]} |
| {"sample_id": "S061", "dataset": "spelling", "input": "أنا ذهبت إلى الجامعة", "expected": "أنا ذهبت إلى الجامعة", "pipeline_output": "أنا ذهبت إلى الجامعة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 656, "punctuation_ms": 436, "spelling_ms": 1618, "total_ms": 2712}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أنا ذهبت إلى الجامعة", "output": "أنا ذهبت إلى الجامعة"}]} |
| {"sample_id": "S062", "dataset": "spelling", "input": "هذه المدرسة جميلة جداً", "expected": "هذه المدرسة جميلة جداً", "pipeline_output": "هذه المدرسة جميلة جداً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 688, "punctuation_ms": 571, "spelling_ms": 1694, "total_ms": 2955}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هذه المدرسة جميلة جداً", "output": "هذه المدرسة جميلة جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 22, "event": "grammar_diff", "original": "جداً", "start": 18}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]} |
| {"sample_id": "S063", "dataset": "spelling", "input": "كان الجو ممطراً اليوم", "expected": "كان الجو ممطراً اليوم", "pipeline_output": "كان الجو ممطراً اليوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 932, "punctuation_ms": 476, "spelling_ms": 2105, "total_ms": 3514}, "telemetry_events": [{"event": "grammar_raw_output", "input": "كان الجو ممطراً اليوم", "output": "كان الجو ممطرا اليوم"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "ممطرا", "end": 15, "event": "grammar_diff", "original": "ممطراً", "start": 9}, {"correction": "ممطرا", "event": "filter_reject", "filter": "TanweenGuard", "original": "ممطراً"}]} |
| {"sample_id": "S064", "dataset": "spelling", "input": "وكان أحمد في المنزل", "expected": "وكان أحمد في المنزل", "pipeline_output": "وكان أحمد في المنزل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 582, "punctuation_ms": 413, "spelling_ms": 1611, "total_ms": 2608}, "telemetry_events": [{"event": "grammar_raw_output", "input": "وكان أحمد في المنزل", "output": "وكان أحمد في المنزل"}]} |
| {"sample_id": "S065", "dataset": "spelling", "input": "إلى اللقاء يا صديقي", "expected": "إلى اللقاء يا صديقي", "pipeline_output": "إلى اللقاء يا صديقي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 534, "punctuation_ms": 369, "spelling_ms": 1929, "total_ms": 2834}, "telemetry_events": [{"event": "grammar_raw_output", "input": "إلى اللقاء يا صديقي", "output": "إلى اللقاء يا صديقي"}]} |
| {"sample_id": "S066", "dataset": "spelling", "input": "ذلك الكتاب مفيد جداً", "expected": "ذلك الكتاب مفيد جداً", "pipeline_output": "ذلك الكتاب مفيد جداً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 636, "punctuation_ms": 364, "spelling_ms": 1924, "total_ms": 2927}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذلك الكتاب مفيد جداً", "output": "ذلك الكتاب مفيد جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 20, "event": "grammar_diff", "original": "جداً", "start": 16}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]} |
| {"sample_id": "S067", "dataset": "spelling", "input": "لكن الأمر صعب علينا", "expected": "لكن الأمر صعب علينا", "pipeline_output": "لكن الأمر صعب علينا", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 536, "punctuation_ms": 417, "spelling_ms": 1946, "total_ms": 2901}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لكن الأمر صعب علينا", "output": "لكن الأمر صعب علينا"}]} |
| {"sample_id": "S068", "dataset": "spelling", "input": "هذا أو ذاك سواء عندي", "expected": "هذا أو ذاك سواء عندي", "pipeline_output": "هذا أو ذاك سواء عندي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 585, "punctuation_ms": 470, "spelling_ms": 2505, "total_ms": 3561}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هذا أو ذاك سواء عندي", "output": "هذا أو ذاك سواء عندي"}]} |
| {"sample_id": "S069", "dataset": "spelling", "input": "الطالب المجتهد ينجح دائماً", "expected": "الطالب المجتهد ينجح دائماً", "pipeline_output": "الطالب المجتهد ينجح دائماً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 695, "punctuation_ms": 497, "spelling_ms": 1750, "total_ms": 2945}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الطالب المجتهد ينجح دائماً", "output": "الطالب المجتهد ينجح دائما"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "دائما", "end": 26, "event": "grammar_diff", "original": "دائماً", "start": 20}, {"correction": "دائما", "event": "filter_reject", "filter": "TanweenGuard", "original": "دائماً"}]} |
| {"sample_id": "S070", "dataset": "spelling", "input": "العلم نور والجهل ظلام", "expected": "العلم نور والجهل ظلام", "pipeline_output": "العلم نور والجهل ظلام", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 706, "punctuation_ms": 496, "spelling_ms": 2873, "total_ms": 4076}, "telemetry_events": [{"event": "grammar_raw_output", "input": "العلم نور والجهل ظلام", "output": "العلم نور والجهل ظلام"}]} |
| {"sample_id": "S071", "dataset": "spelling", "input": "أحب القراءة والكتابة", "expected": "أحب القراءة والكتابة", "pipeline_output": "أحب القراءة والكتابة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 435, "punctuation_ms": 448, "spelling_ms": 1342, "total_ms": 2227}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أحب القراءة والكتابة", "output": "أحب القراءة والكتابة"}]} |
| {"sample_id": "S072", "dataset": "spelling", "input": "المعلم يشرح الدرس", "expected": "المعلم يشرح الدرس", "pipeline_output": "المعلم يشرح الدرس", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 476, "punctuation_ms": 408, "spelling_ms": 1410, "total_ms": 2296}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المعلم يشرح الدرس", "output": "المعلم يشرح الدرس"}]} |
| {"sample_id": "S073", "dataset": "spelling", "input": "ذهبت إلى السوق واشتريت خبزاً", "expected": "ذهبت إلى السوق واشتريت خبزاً", "pipeline_output": "ذهبت إلى السوق واشتريت خبزاً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 898, "punctuation_ms": 660, "spelling_ms": 2355, "total_ms": 3915}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ذهبت إلى السوق واشتريت خبزاً", "output": "ذهبت إلى السوق واشتريت خبزا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "خبزا", "end": 28, "event": "grammar_diff", "original": "خبزاً", "start": 23}, {"correction": "خبزا", "event": "filter_reject", "filter": "TanweenGuard", "original": "خبزاً"}]} |
| {"sample_id": "S074", "dataset": "spelling", "input": "الطقس جميل في الربيع", "expected": "الطقس جميل في الربيع", "pipeline_output": "الطقس جميل في الربيع", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 632, "punctuation_ms": 402, "spelling_ms": 1628, "total_ms": 2663}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الطقس جميل في الربيع", "output": "الطقس جميل في الربيع"}]} |
| {"sample_id": "S075", "dataset": "spelling", "input": "نحن نعمل بجد كل يوم", "expected": "نحن نعمل بجد كل يوم", "pipeline_output": "نحن نعمل بجد كل يوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 581, "punctuation_ms": 354, "spelling_ms": 2854, "total_ms": 3791}, "telemetry_events": [{"event": "grammar_raw_output", "input": "نحن نعمل بجد كل يوم", "output": "نحن نعمل بجد كل يوم"}]} |
| {"sample_id": "S076", "dataset": "spelling", "input": "انا ذهبت الي المدرسه", "expected": "أنا ذهبت إلى المدرسة", "pipeline_output": "أنا ذهبت إلى المدرسة", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 536, "punctuation_ms": 417, "spelling_ms": 3213, "total_ms": 4169}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أنا ذهبت إلى المدرسة", "output": "أنا ذهبت إلى المدرسة"}]} |
| {"sample_id": "S077", "dataset": "spelling", "input": "ايضا الجامعه كبيره", "expected": "أيضاً الجامعة كبيرة", "pipeline_output": "أيضا الجامعة هي كبيرة", "passed": false, "suggestion_count": 2, "timing": {"grammar_ms": 590, "punctuation_ms": 398, "spelling_ms": 2260, "total_ms": 3251}, "telemetry_events": [{"event": "grammar_raw_output", "input": "ايضا الجامعه هي كبيرة", "output": "أيضا الجامعة هي كبيرة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "أيضا الجامعة", "end": 12, "event": "grammar_diff", "original": "ايضا الجامعه", "start": 0}, {"correction": "أيضا الجامعة", "end": 12, "event": "patch_accepted", "original": "ايضا الجامعه", "stage": "spelling", "start": 0}]} |
| {"sample_id": "S078", "dataset": "spelling", "input": "لان المدرسه بعيده جداً", "expected": "لأن المدرسة بعيدة جداً", "pipeline_output": "لأن المدرسة بعيدة جداً", "passed": true, "suggestion_count": 3, "timing": {"grammar_ms": 686, "punctuation_ms": 532, "spelling_ms": 2533, "total_ms": 3754}, "telemetry_events": [{"event": "grammar_raw_output", "input": "لأن المدرسة بعيدة جداً", "output": "لأن المدرسة بعيدة جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 22, "event": "grammar_diff", "original": "جداً", "start": 18}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]} |
| {"sample_id": "S079", "dataset": "spelling", "input": "اين الجامعه الكبيره", "expected": "أين الجامعة الكبيرة", "pipeline_output": "اين أن الجامعة الكبيرة", "passed": false, "suggestion_count": 2, "timing": {"grammar_ms": 535, "punctuation_ms": 534, "spelling_ms": 3206, "total_ms": 4277}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اين أن الجامعة الكبيرة", "output": "اين أن الجامعة الكبيرة"}]} |
| {"sample_id": "S080", "dataset": "spelling", "input": "اول مره ازور المكتبه", "expected": "أول مرة أزور المكتبة", "pipeline_output": "أول مرة أزور المكتبة", "passed": true, "suggestion_count": 4, "timing": {"grammar_ms": 591, "punctuation_ms": 457, "spelling_ms": 2472, "total_ms": 3523}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أول مرة أزور المكتبة", "output": "أول مرة أزور المكتبة"}]} |
| {"sample_id": "SC001", "dataset": "structured_content", "input": "زر الموقع https://example.com للمزيد", "expected": "زر الموقع https://example.com للمزيد", "pipeline_output": "زر الموقع https://example.com للمزيد", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 632, "punctuation_ms": 1073, "spelling_ms": 0, "total_ms": 1706}, "telemetry_events": [{"event": "grammar_raw_output", "input": "زر الموقع بيان للمزيد", "output": "زر الموقع بيانا للمزيد"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "https://example.comا", "end": 29, "event": "grammar_diff", "original": "https://example.com", "start": 10}, {"correction": "https://example.comا", "event": "filter_reject", "filter": "LatinGuard", "original": "https://example.com"}]} |
| {"sample_id": "SC002", "dataset": "structured_content", "input": "الرابط https://www.google.com/search?q=test يعمل", "expected": "الرابط https://www.google.com/search?q=test يعمل", "pipeline_output": "الرابط https://www.google.com/search?q=test يعمل", "passed": true, "suggestion_count": 0, "timing": {}, "telemetry_events": []} |
| {"sample_id": "SC003", "dataset": "structured_content", "input": "موقع http://localhost:8080/api جاهز", "expected": "موقع http://localhost:8080/api جاهز", "pipeline_output": "موقع http://localhost:8080/api جاهز", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 534, "punctuation_ms": 1395, "spelling_ms": 0, "total_ms": 1931}, "telemetry_events": [{"event": "grammar_raw_output", "input": "موقع بيان جاهز", "output": "موقع بيان جاهز"}]} |
| {"sample_id": "SC004", "dataset": "structured_content", "input": "اقرأ المقال على https://medium.com/@user/article-title", "expected": "اقرأ المقال على https://medium.com/@user/article-title", "pipeline_output": "اقرأ المقال على https://medium.com/@user/article-title", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 633, "punctuation_ms": 1880, "spelling_ms": 0, "total_ms": 2514}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اقرأ المقال على بيان", "output": "اقرأ المقال على بيان"}]} |
| {"sample_id": "SC005", "dataset": "structured_content", "input": "أرسل لي على info@company.com", "expected": "أرسل لي على info@company.com", "pipeline_output": "أرسل لي على info@company.com", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 530, "punctuation_ms": 713, "spelling_ms": 0, "total_ms": 1244}, "telemetry_events": [{"event": "grammar_raw_output", "input": "أرسل لي على بيان", "output": "أرسل لي على بيان"}]} |
| {"sample_id": "SC006", "dataset": "structured_content", "input": "بريدي user.name@gmail.com للتواصل", "expected": "بريدي user.name@gmail.com للتواصل", "pipeline_output": "بريدي user.name@gmail.com للتواصل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 632, "punctuation_ms": 907, "spelling_ms": 0, "total_ms": 1540}, "telemetry_events": [{"event": "grammar_raw_output", "input": "بريدي بيانلتواصل", "output": "بريدي بيان للتواصل"}]} |
| {"sample_id": "SC007", "dataset": "structured_content", "input": "تواصل عبر support@bayan.ai", "expected": "تواصل عبر support@bayan.ai", "pipeline_output": "تواصل عبر support@bayan.ai", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 581, "punctuation_ms": 494, "spelling_ms": 0, "total_ms": 1076}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تواصل عبر بيان", "output": "تواصل عبر بيان"}]} |
| {"sample_id": "SC008", "dataset": "structured_content", "input": "تاريخ اليوم 15/06/2026", "expected": "تاريخ اليوم 15/06/2026", "pipeline_output": "تاريخ اليوم 15/06/2026", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 533, "punctuation_ms": 493, "spelling_ms": 6514, "total_ms": 7542}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تاريخ اليوم بيان", "output": "تاريخ اليوم بيان"}]} |
| {"sample_id": "SC009", "dataset": "structured_content", "input": "الموعد يوم 2026-06-22", "expected": "الموعد يوم 2026-06-22", "pipeline_output": "الموعد يوم 2026-06-22", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 634, "punctuation_ms": 629, "spelling_ms": 4981, "total_ms": 6246}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الموعد يوم 20بيان", "output": "الموعد يوم عشرين بيانا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "عشرين 26-06-22ا", "end": 21, "event": "grammar_diff", "original": "2026-06-22", "start": 11}, {"correction": "عشرين 26-06-22ا", "event": "filter_reject", "filter": "DigitGuard", "original": "2026-06-22"}]} |
| {"sample_id": "SC010", "dataset": "structured_content", "input": "في تاريخ 01/01/2025 بدأنا", "expected": "في تاريخ 01/01/2025 بدأنا", "pipeline_output": "في تاريخ 01/01/2025 بدأنا", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 533, "punctuation_ms": 681, "spelling_ms": 5836, "total_ms": 7052}, "telemetry_events": [{"event": "grammar_raw_output", "input": "في تاريخ بيان بدأنا", "output": "في تاريخ بيان بدأنا"}]} |
| {"sample_id": "SC011", "dataset": "structured_content", "input": "الساعة 14:30 عصراً", "expected": "الساعة 14:30 عصراً", "pipeline_output": "الساعة 14:30 عصراً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 587, "punctuation_ms": 518, "spelling_ms": 4659, "total_ms": 5766}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الساعة بيان عصراً", "output": "الساعة بيان عصرا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "عصرا", "end": 18, "event": "grammar_diff", "original": "عصراً", "start": 13}, {"correction": "عصرا", "event": "filter_reject", "filter": "TanweenGuard", "original": "عصراً"}]} |
| {"sample_id": "SC012", "dataset": "structured_content", "input": "الموعد الساعة 3:30 مساءً", "expected": "الموعد الساعة 3:30 مساءً", "pipeline_output": "الموعد الساعة 3:30 مساءً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 834, "punctuation_ms": 598, "spelling_ms": 4998, "total_ms": 6432}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الموعد الساعة بيان مساءً", "output": "الموعد الساعة بيان مساء"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "مساء", "end": 24, "event": "grammar_diff", "original": "مساءً", "start": 19}, {"correction": "مساء", "event": "filter_reject", "filter": "TanweenGuard", "original": "مساءً"}]} |
| {"sample_id": "SC013", "dataset": "structured_content", "input": "يبدأ الاجتماع 09:00 صباحاً", "expected": "يبدأ الاجتماع 09:00 صباحاً", "pipeline_output": "يبدأ الاجتماع 09:00 صباحاً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 782, "punctuation_ms": 787, "spelling_ms": 7055, "total_ms": 8626}, "telemetry_events": [{"event": "grammar_raw_output", "input": "يبدأ الاجتماع بيان صباحاً", "output": "يبدأ الاجتماع بيانا صباحا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "09:00ا صباحا", "end": 26, "event": "grammar_diff", "original": "09:00 صباحاً", "start": 14}, {"correction": "09:00ا صباحا", "event": "filter_reject", "filter": "DigitGuard", "original": "09:00 صباحاً"}]} |
| {"sample_id": "SC014", "dataset": "structured_content", "input": "المسافة 25.5 كيلومتر", "expected": "المسافة 25.5 كيلومتر", "pipeline_output": "المسافة 25.5 كيلومتر", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 682, "punctuation_ms": 442, "spelling_ms": 5551, "total_ms": 6677}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المسافة 25.5 كيلومتر", "output": "المسافة ثلاث عشر كيلومترا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "ثلاث عشر كيلومترا", "end": 20, "event": "grammar_diff", "original": "25.5 كيلومتر", "start": 8}, {"correction": "ثلاث عشر كيلومترا", "event": "filter_reject", "filter": "DigitGuard", "original": "25.5 كيلومتر"}]} |
| {"sample_id": "SC015", "dataset": "structured_content", "input": "السعر 1,000,000 جنيه", "expected": "السعر 1,000,000 جنيه", "pipeline_output": "السعر 1,000,000 جنيه", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 491, "punctuation_ms": 723, "spelling_ms": 4163, "total_ms": 5379}, "telemetry_events": [{"event": "grammar_raw_output", "input": "السعر 1,000,000 جنيه", "output": "السعر 1 , 000 , 000 جنيه"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "1 , 000 , 000", "end": 15, "event": "grammar_diff", "original": "1,000,000", "start": 6}, {"correction": "1 , 000 , 000", "event": "filter_reject", "filter": "DigitGuard", "original": "1,000,000"}]} |
| {"sample_id": "SC016", "dataset": "structured_content", "input": "النسبة 95.7% من الطلاب نجحوا", "expected": "النسبة 95.7% من الطلاب نجحوا", "pipeline_output": "النسبة 95.7% من الطلاب نجحوا", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 833, "punctuation_ms": 891, "spelling_ms": 0, "total_ms": 1725}, "telemetry_events": [{"event": "grammar_raw_output", "input": "النسبة 95.7% من الطلاب نجحوا", "output": "النسبة 95 ، 7 % من الطلاب نجحوا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "95 ، 7 %", "end": 12, "event": "grammar_diff", "original": "95.7%", "start": 7}, {"correction": "95 ، 7 %", "event": "filter_reject", "filter": "DigitGuard", "original": "95.7%"}]} |
| {"sample_id": "SC017", "dataset": "structured_content", "input": "الثمن 500$ أمريكي", "expected": "الثمن 500$ أمريكي", "pipeline_output": "الثمن 500$ أمريكي", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 534, "punctuation_ms": 480, "spelling_ms": 2624, "total_ms": 3640}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الثمن 500$ أمريكي", "output": "الثمن 500 $ أمريكي"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "500 $", "end": 10, "event": "grammar_diff", "original": "500$", "start": 6}]} |
| {"sample_id": "SC018", "dataset": "structured_content", "input": "الميزانية 100 جنيه مصري", "expected": "الميزانية 100 جنيه مصري", "pipeline_output": "الميزانية 100 جنيه مصري", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 494, "punctuation_ms": 415, "spelling_ms": 2138, "total_ms": 3049}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الميزانية 100 جنيه مصري", "output": "الميزانية مائة جنيه مصري"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "مائة", "end": 13, "event": "grammar_diff", "original": "100", "start": 10}, {"correction": "مائة", "event": "filter_reject", "filter": "Jaccard_03", "jaccard": 0.0, "original": "100"}]} |
| {"sample_id": "SC019", "dataset": "structured_content", "input": "الحرارة 35°C اليوم", "expected": "الحرارة 35°C اليوم", "pipeline_output": "الحرارة 35°C اليوم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 678, "punctuation_ms": 455, "spelling_ms": 1951, "total_ms": 3085}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الحرارة 35°C اليوم", "output": "الحرارة 35 ° C اليوم"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "35 ° C", "end": 12, "event": "grammar_diff", "original": "35°C", "start": 8}, {"correction": "35 ° C", "event": "filter_reject", "filter": "LatinGuard", "original": "35°C"}]} |
| {"sample_id": "SC020", "dataset": "structured_content", "input": "المسافة 25km تقريباً", "expected": "المسافة 25km تقريباً", "pipeline_output": "المسافة 25km تقريباً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 730, "punctuation_ms": 537, "spelling_ms": 4165, "total_ms": 5434}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المسافة 25km تقريباً", "output": "المسافة 25km تقريبا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "تقريبا", "end": 20, "event": "grammar_diff", "original": "تقريباً", "start": 13}, {"correction": "تقريبا", "event": "filter_reject", "filter": "TanweenGuard", "original": "تقريباً"}]} |
| {"sample_id": "SC021", "dataset": "structured_content", "input": "الوزن 75kg", "expected": "الوزن 75kg", "pipeline_output": "الوزن 75kg", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 623, "punctuation_ms": 443, "spelling_ms": 2716, "total_ms": 3785}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الوزن 75kg", "output": "الوزن75kg"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "الوزن75kg", "end": 10, "event": "grammar_diff", "original": "الوزن 75kg", "start": 0}, {"correction": "الوزن75kg", "event": "filter_reject", "filter": "LatinGuard", "original": "الوزن 75kg"}]} |
| {"sample_id": "SC022", "dataset": "structured_content", "input": "استخدم print('مرحبا') للطباعة", "expected": "استخدم print('مرحبا') للطباعة", "pipeline_output": "استخدم print('مرحبا') للطباعة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1228, "punctuation_ms": 873, "spelling_ms": 0, "total_ms": 2103}, "telemetry_events": [{"event": "grammar_raw_output", "input": "استخدم print('مرحبا') للطباعة", "output": "استخدم print ، ' مرحباا ، للطباعة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "print ، ' مرحباا ،", "end": 21, "event": "grammar_diff", "original": "print('مرحبا')", "start": 7}, {"correction": "print ، ' مرحباا ،", "event": "filter_reject", "filter": "LatinGuard", "original": "print('مرحبا')"}]} |
| {"sample_id": "SC023", "dataset": "structured_content", "input": "المتغير const x = 5; في جافاسكريبت", "expected": "المتغير const x = 5; في جافاسكريبت", "pipeline_output": "المتغير const x = 5; في جافاسكريبت", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1384, "punctuation_ms": 976, "spelling_ms": 0, "total_ms": 2362}, "telemetry_events": [{"event": "grammar_raw_output", "input": "المتغير const x = 5; في جافاسكريبت", "output": "المتغير const x = خمسة ; في جافاسكريبت"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "خمسة ;", "end": 20, "event": "grammar_diff", "original": "5;", "start": 18}, {"correction": "خمسة ;", "event": "filter_reject", "filter": "Jaccard_03", "jaccard": 0.167, "original": "5;"}]} |
| {"sample_id": "SC024", "dataset": "structured_content", "input": "الدالة function test() {} تعمل", "expected": "الدالة function test() {} تعمل", "pipeline_output": "الدالة function test() {} تعمل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1443, "punctuation_ms": 635, "spelling_ms": 0, "total_ms": 2080}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الدالة function test() {} تعمل", "output": "الدالة function test ، وذلك { } تعمل"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "test ، وذلك { }", "end": 25, "event": "grammar_diff", "original": "test() {}", "start": 16}, {"correction": "test ، وذلك { }", "event": "filter_reject", "filter": "LatinGuard", "original": "test() {}"}]} |
| {"sample_id": "SC025", "dataset": "structured_content", "input": "الاستعلام SELECT * FROM users يعمل", "expected": "الاستعلام SELECT * FROM users يعمل", "pipeline_output": "الاستعلام SELECT * FROM users يعمل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1079, "punctuation_ms": 740, "spelling_ms": 0, "total_ms": 1820}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الاستعلام SELECT * FROM users يعمل", "output": "الاستعلام SELECT * FROM users يعمل"}]} |
| {"sample_id": "SC026", "dataset": "structured_content", "input": "البيانات {\"name\":\"Mohamed\"} صحيحة", "expected": "البيانات {\"name\":\"Mohamed\"} صحيحة", "pipeline_output": "البيانات {\"name\":\"Mohamed\"} صحيحة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 1435, "punctuation_ms": 1153, "spelling_ms": 0, "total_ms": 2589}, "telemetry_events": [{"event": "grammar_raw_output", "input": "البيانات {\"name\":\"Mohamed\"} صحيحة", "output": "البيانات { \" name \" : \" Mohamed \" } صحيحة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "{ \" name \" : \" Mohamed \" }", "end": 27, "event": "grammar_diff", "original": "{\"name\":\"Mohamed\"}", "start": 9}, {"correction": "{ \" name \" : \" Mohamed \" }", "event": "filter_reject", "filter": "LatinGuard", "original": "{\"name\":\"Mohamed\"}"}]} |
| {"sample_id": "SC027", "dataset": "structured_content", "input": "مشروع #بيان رائع جداً", "expected": "مشروع #بيان رائع جداً", "pipeline_output": "مشروع #بيان رائع جداً", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 733, "punctuation_ms": 379, "spelling_ms": 0, "total_ms": 1114}, "telemetry_events": [{"event": "grammar_raw_output", "input": "مشروع بيان رائع جداً", "output": "مشروع بيان رائع جدا"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "جدا", "end": 21, "event": "grammar_diff", "original": "جداً", "start": 17}, {"correction": "جدا", "event": "filter_reject", "filter": "TanweenGuard", "original": "جداً"}]} |
| {"sample_id": "SC028", "dataset": "structured_content", "input": "هاشتاق #الذكاء_الاصطناعي مهم", "expected": "هاشتاق #الذكاء_الاصطناعي مهم", "pipeline_output": "هاشتاق #الذكاء_الاصطناعي مهم", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 528, "punctuation_ms": 552, "spelling_ms": 0, "total_ms": 1082}, "telemetry_events": [{"event": "grammar_raw_output", "input": "هاشتاق بيان مهم", "output": "هاشتاق بيان مهم"}]} |
| {"sample_id": "SC029", "dataset": "structured_content", "input": "شكراً @mohamedatef على المساعدة", "expected": "شكراً @mohamedatef على المساعدة", "pipeline_output": "شكراً @mohamedatef على المساعدة", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 692, "punctuation_ms": 944, "spelling_ms": 0, "total_ms": 1638}, "telemetry_events": [{"event": "grammar_raw_output", "input": "شكراً بيان على المساعدة", "output": "شكرا بيان على المساعدة"}, {"count": 1, "event": "grammar_diffs_extracted"}, {"correction": "شكرا", "end": 5, "event": "grammar_diff", "original": "شكراً", "start": 0}, {"correction": "شكرا", "event": "filter_reject", "filter": "TanweenGuard", "original": "شكراً"}]} |
| {"sample_id": "SC030", "dataset": "structured_content", "input": "تابع @bayan_app للتحديثات", "expected": "تابع @bayan_app للتحديثات", "pipeline_output": "تابع @bayan_app للتحديثات", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 734, "punctuation_ms": 5888, "spelling_ms": 5837, "total_ms": 12461}, "telemetry_events": [{"event": "grammar_raw_output", "input": "تابع بيان للتحديثات", "output": "تابع بيان للتحديثات"}]} |
| {"sample_id": "SC031", "dataset": "structured_content", "input": "اتصل على 01012345678 للاستفسار", "expected": "اتصل على 01012345678 للاستفسار", "pipeline_output": "اتصل على 01012345678 للاستفسار", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 630, "punctuation_ms": 645, "spelling_ms": 4861, "total_ms": 6138}, "telemetry_events": [{"event": "grammar_raw_output", "input": "اتصل على بيان للاستفسار", "output": "اتصل على بيان للاستفسار"}]} |
| {"sample_id": "SC032", "dataset": "structured_content", "input": "الرقم +201012345678 متاح", "expected": "الرقم +201012345678 متاح", "pipeline_output": "الرقم +201012345678 متاح", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 480, "punctuation_ms": 516, "spelling_ms": 6117, "total_ms": 7115}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الرقم بيان متاح", "output": "الرقم بيان متاح"}]} |
| {"sample_id": "SC033", "dataset": "structured_content", "input": "الخادم على 192.168.1.1 يعمل", "expected": "الخادم على 192.168.1.1 يعمل", "pipeline_output": "الخادم على 192.168.1.1 يعمل", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 631, "punctuation_ms": 514, "spelling_ms": 8901, "total_ms": 10049}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الخادم على بيان يعمل", "output": "الخادم على بيان يعمل"}]} |
| {"sample_id": "SC034", "dataset": "structured_content", "input": "الإصدار v2.1.0 متاح", "expected": "الإصدار v2.1.0 متاح", "pipeline_output": "الإصدار v2.1.0 متاح", "passed": true, "suggestion_count": 0, "timing": {"grammar_ms": 480, "punctuation_ms": 501, "spelling_ms": 6267, "total_ms": 7249}, "telemetry_events": [{"event": "grammar_raw_output", "input": "الإصدار بيان متاح", "output": "الإصدار بيان متاح"}]} |
| {"sample_id": "SC035", "dataset": "structured_content", "input": "الملف في C:\\Users\\test\\file.txt", "expected": "الملف في C:\\Users\\test\\file.txt", "pipeline_output": "الملف في C:\\Users\\test\\file.txt", "passed": true, "suggestion_count": 0, "timing": {}, "telemetry_events": []} |
|
|