chen459664 commited on
Commit
b89bb8b
·
verified ·
1 Parent(s): 8c6338f

Add files using upload-large-folder tool

Browse files
This view is limited to 50 files because it contains too many changes.   See raw diff
Files changed (50) hide show
  1. lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_2/afrimgsm_cot_lin.yaml +4 -0
  2. lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_4/afrimgsm_cot_eng.yaml +7 -0
  3. lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_4/afrimgsm_cot_zul.yaml +7 -0
  4. lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_5/afrimgsm_cot_ibo.yaml +7 -0
  5. lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_5/afrimgsm_cot_kin.yaml +7 -0
  6. lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_5/afrimgsm_cot_lug.yaml +7 -0
  7. lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_5/afrimgsm_cot_twi.yaml +7 -0
  8. lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_5/afrimgsm_cot_vai.yaml +7 -0
  9. lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_5/afrimgsm_cot_zul.yaml +7 -0
  10. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_amh.yaml +4 -0
  11. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_ewe.yaml +4 -0
  12. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_hau.yaml +4 -0
  13. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_sna.yaml +4 -0
  14. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_swa.yaml +4 -0
  15. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_twi.yaml +4 -0
  16. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_wol.yaml +4 -0
  17. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_yaml +32 -0
  18. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_amh.yaml +4 -0
  19. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_ewe.yaml +4 -0
  20. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_fra.yaml +4 -0
  21. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_ibo.yaml +4 -0
  22. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_lin.yaml +4 -0
  23. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_lug.yaml +4 -0
  24. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_orm.yaml +4 -0
  25. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_sot.yaml +4 -0
  26. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_swa.yaml +4 -0
  27. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_twi.yaml +4 -0
  28. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_wol.yaml +4 -0
  29. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_xho.yaml +4 -0
  30. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_yor.yaml +4 -0
  31. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_zul.yaml +4 -0
  32. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_amh.yaml +4 -0
  33. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_ewe.yaml +4 -0
  34. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_fra.yaml +4 -0
  35. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_hau.yaml +4 -0
  36. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_ibo.yaml +4 -0
  37. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_kin.yaml +4 -0
  38. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_lin.yaml +4 -0
  39. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_lug.yaml +4 -0
  40. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_orm.yaml +4 -0
  41. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_sna.yaml +4 -0
  42. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_sot.yaml +4 -0
  43. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_swa.yaml +4 -0
  44. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_twi.yaml +4 -0
  45. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_wol.yaml +4 -0
  46. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_xho.yaml +4 -0
  47. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_yaml +32 -0
  48. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_yor.yaml +4 -0
  49. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_zul.yaml +4 -0
  50. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_4/afrimgsm_translate_amh.yaml +7 -0
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_2/afrimgsm_cot_lin.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: lin
3
+ include: afrimgsm_cot_yaml
4
+ task: afrimgsm_cot_lin_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_4/afrimgsm_cot_eng.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: eng
3
+ doc_to_text: "Answer the given question with the step by step solution appropriate\
4
+ \ numerical value, ensuring that the response is clear and without any supplementary\
5
+ \ information. \n\nQuestion: {{question}} \nStep by step answer: "
6
+ include: afrimgsm_cot_yaml
7
+ task: afrimgsm_cot_eng_prompt_4
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_4/afrimgsm_cot_zul.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: zul
3
+ doc_to_text: "Answer the given question with the step by step solution appropriate\
4
+ \ numerical value, ensuring that the response is clear and without any supplementary\
5
+ \ information. \n\nQuestion: {{question}} \nStep by step answer: "
6
+ include: afrimgsm_cot_yaml
7
+ task: afrimgsm_cot_zul_prompt_4
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_5/afrimgsm_cot_ibo.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: ibo
3
+ doc_to_text: "For mathematical questions provided in Igbo language. Supply the accurate\
4
+ \ step by step answer to the provided question. \n\nQuestion: {{question}} \nStep\
5
+ \ by step answer: "
6
+ include: afrimgsm_cot_yaml
7
+ task: afrimgsm_cot_ibo_prompt_5
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_5/afrimgsm_cot_kin.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: kin
3
+ doc_to_text: "For mathematical questions provided in Kinyarwanda language. Supply\
4
+ \ the accurate step by step answer to the provided question. \n\nQuestion: {{question}}\
5
+ \ \nStep by step answer: "
6
+ include: afrimgsm_cot_yaml
7
+ task: afrimgsm_cot_kin_prompt_5
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_5/afrimgsm_cot_lug.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: lug
3
+ doc_to_text: "For mathematical questions provided in Luganda language. Supply the\
4
+ \ accurate step by step answer to the provided question. \n\nQuestion: {{question}}\
5
+ \ \nStep by step answer: "
6
+ include: afrimgsm_cot_yaml
7
+ task: afrimgsm_cot_lug_prompt_5
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_5/afrimgsm_cot_twi.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: twi
3
+ doc_to_text: "For mathematical questions provided in Twi language. Supply the accurate\
4
+ \ step by step answer to the provided question. \n\nQuestion: {{question}} \nStep\
5
+ \ by step answer: "
6
+ include: afrimgsm_cot_yaml
7
+ task: afrimgsm_cot_twi_prompt_5
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_5/afrimgsm_cot_vai.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: vai
3
+ doc_to_text: "For mathematical questions provided in Vai language. Supply the accurate\
4
+ \ step by step answer to the provided question. \n\nQuestion: {{question}} \nStep\
5
+ \ by step answer: "
6
+ include: afrimgsm_cot_yaml
7
+ task: afrimgsm_cot_vai_prompt_5
lm-evaluation-harness/lm_eval/tasks/afrimgsm/direct_cot/prompt_5/afrimgsm_cot_zul.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: zul
3
+ doc_to_text: "For mathematical questions provided in Zulu language. Supply the accurate\
4
+ \ step by step answer to the provided question. \n\nQuestion: {{question}} \nStep\
5
+ \ by step answer: "
6
+ include: afrimgsm_cot_yaml
7
+ task: afrimgsm_cot_zul_prompt_5
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_amh.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: amh
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_amh_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_ewe.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: ewe
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_ewe_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_hau.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: hau
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_hau_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_sna.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: sna
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_sna_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_swa.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: swa
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_swa_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_twi.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: twi
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_twi_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_wol.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: wol
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_wol_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_1/afrimgsm_translate_yaml ADDED
@@ -0,0 +1,32 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ tag: afrimgsm_tt_tasks
2
+ dataset_path: masakhane/afrimgsm-translate-test
3
+ output_type: generate_until
4
+ test_split: test
5
+ doc_to_target: '{% if answer is not none %}{{answer[21:]}}{% else %}{{answer_number|string}}{% endif %}'
6
+ doc_to_text: '{% if answer is not none %}{{question+"\nAnswer:"}}{% else %}{{"Question: "+question+"\nAnswer:"}}{% endif %}'
7
+ target_delimiter: ""
8
+ generation_kwargs:
9
+ do_sample: false
10
+ until:
11
+ - 'Question:'
12
+ - </s>
13
+ - <|im_end|>
14
+ filter_list:
15
+ - name: remove_whitespace
16
+ filter:
17
+ - function: remove_whitespace
18
+ - function: take_first
19
+ - filter:
20
+ - function: regex
21
+ group_select: -1
22
+ regex_pattern: (-?[$0-9.,]{2,})|(-?[0-9]+)
23
+ - function: take_first
24
+ name: flexible-extract
25
+ metric_list:
26
+ - metric: exact_match
27
+ aggregation: mean
28
+ higher_is_better: true
29
+ ignore_case: true
30
+ ignore_punctuation: true
31
+ metadata:
32
+ version: 2.0
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_amh.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: amh
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_amh_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_ewe.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: ewe
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_ewe_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_fra.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: fra
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_fra_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_ibo.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: ibo
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_ibo_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_lin.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: lin
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_lin_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_lug.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: lug
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_lug_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_orm.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: orm
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_orm_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_sot.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: sot
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_sot_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_swa.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: swa
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_swa_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_twi.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: twi
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_twi_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_wol.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: wol
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_wol_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_xho.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: xho
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_xho_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_yor.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: yor
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_yor_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_2/afrimgsm_translate_zul.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: zul
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_zul_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_amh.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: amh
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_amh_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_ewe.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: ewe
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_ewe_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_fra.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: fra
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_fra_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_hau.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: hau
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_hau_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_ibo.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: ibo
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_ibo_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_kin.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: kin
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_kin_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_lin.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: lin
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_lin_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_lug.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: lug
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_lug_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_orm.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: orm
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_orm_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_sna.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: sna
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_sna_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_sot.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: sot
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_sot_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_swa.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: swa
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_swa_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_twi.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: twi
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_twi_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_wol.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: wol
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_wol_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_xho.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: xho
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_xho_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_yaml ADDED
@@ -0,0 +1,32 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ tag: afrimgsm_tt_tasks
2
+ dataset_path: masakhane/afrimgsm-translate-test
3
+ output_type: generate_until
4
+ test_split: test
5
+ doc_to_target: '{% if answer is not none %}{{answer[21:]}}{% else %}{{answer_number|string}}{% endif %}'
6
+ doc_to_text: "Solve the following math question \n\nQuestion: {{question}} \nAnswer: "
7
+ target_delimiter: ""
8
+ generation_kwargs:
9
+ do_sample: false
10
+ until:
11
+ - 'Question:'
12
+ - </s>
13
+ - <|im_end|>
14
+ filter_list:
15
+ - name: remove_whitespace
16
+ filter:
17
+ - function: remove_whitespace
18
+ - function: take_first
19
+ - filter:
20
+ - function: regex
21
+ group_select: -1
22
+ regex_pattern: (-?[$0-9.,]{2,})|(-?[0-9]+)
23
+ - function: take_first
24
+ name: flexible-extract
25
+ metric_list:
26
+ - metric: exact_match
27
+ aggregation: mean
28
+ higher_is_better: true
29
+ ignore_case: true
30
+ ignore_punctuation: true
31
+ metadata:
32
+ version: 2.0
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_yor.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: yor
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_yor_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_3/afrimgsm_translate_zul.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: zul
3
+ include: afrimgsm_translate_yaml
4
+ task: afrimgsm_translate_zul_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_4/afrimgsm_translate_amh.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: amh
3
+ doc_to_text: "Answer the given question with the appropriate numerical value, ensuring\
4
+ \ that the response is clear and without any supplementary information. \n\nQuestion:\
5
+ \ {{question}} \nAnswer: "
6
+ include: afrimgsm_translate_yaml
7
+ task: afrimgsm_translate_amh_prompt_4