chen459664 commited on
Commit
0dfd8d2
·
verified ·
1 Parent(s): 4f918cc

Add files using upload-large-folder tool

Browse files
This view is limited to 50 files because it contains too many changes.   See raw diff
Files changed (50) hide show
  1. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_5/afrimgsm_translate_sot.yaml +7 -0
  2. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_5/afrimgsm_translate_zul.yaml +6 -0
  3. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_ewe.yaml +4 -0
  4. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_ibo.yaml +4 -0
  5. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_lin.yaml +4 -0
  6. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_sna.yaml +4 -0
  7. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_twi.yaml +4 -0
  8. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_vai.yaml +4 -0
  9. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_wol.yaml +4 -0
  10. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_yaml +33 -0
  11. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_zul.yaml +4 -0
  12. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_kin.yaml +4 -0
  13. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_lin.yaml +4 -0
  14. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_orm.yaml +4 -0
  15. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_sna.yaml +4 -0
  16. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_sot.yaml +4 -0
  17. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_swa.yaml +4 -0
  18. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_twi.yaml +4 -0
  19. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_vai.yaml +4 -0
  20. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_wol.yaml +4 -0
  21. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_xho.yaml +4 -0
  22. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_yaml +33 -0
  23. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_yor.yaml +4 -0
  24. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_zul.yaml +4 -0
  25. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_amh.yaml +4 -0
  26. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_ewe.yaml +4 -0
  27. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_fra.yaml +4 -0
  28. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_hau.yaml +4 -0
  29. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_ibo.yaml +4 -0
  30. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_kin.yaml +4 -0
  31. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_lin.yaml +4 -0
  32. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_lug.yaml +4 -0
  33. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_orm.yaml +4 -0
  34. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_sna.yaml +4 -0
  35. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_sot.yaml +4 -0
  36. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_swa.yaml +4 -0
  37. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_twi.yaml +4 -0
  38. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_vai.yaml +4 -0
  39. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_wol.yaml +4 -0
  40. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_xho.yaml +4 -0
  41. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_yaml +33 -0
  42. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_yor.yaml +4 -0
  43. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_zul.yaml +4 -0
  44. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_amh.yaml +7 -0
  45. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_ewe.yaml +7 -0
  46. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_fra.yaml +7 -0
  47. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_hau.yaml +7 -0
  48. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_ibo.yaml +7 -0
  49. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_kin.yaml +7 -0
  50. lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_lin.yaml +7 -0
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_5/afrimgsm_translate_sot.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: sot
3
+ doc_to_text: "For mathematical questions provided in Sesotho language. Supply the\
4
+ \ accurate numeric answer to the provided question. \n\nQuestion: {{question}} \n\
5
+ Answer: "
6
+ include: afrimgsm_translate_yaml
7
+ task: afrimgsm_translate_sot_prompt_5
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_5/afrimgsm_translate_zul.yaml ADDED
@@ -0,0 +1,6 @@
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: zul
3
+ doc_to_text: "For mathematical questions provided in Zulu language. Supply the accurate\
4
+ \ numeric answer to the provided question. \n\nQuestion: {{question}} \nAnswer: "
5
+ include: afrimgsm_translate_yaml
6
+ task: afrimgsm_translate_zul_prompt_5
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_ewe.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: ewe
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_ewe_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_ibo.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: ibo
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_ibo_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_lin.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: lin
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_lin_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_sna.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: sna
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_sna_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_twi.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: twi
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_twi_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_vai.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: vai
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_vai_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_wol.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: wol
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_wol_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_yaml ADDED
@@ -0,0 +1,33 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ tag: afrimgsm_tt_cot_tasks
2
+ dataset_path: masakhane/afrimgsm-translate-test
3
+ dataset_name: null # Overridden by language-specific config.
4
+ output_type: generate_until
5
+ test_split: test
6
+ doc_to_target: '{% if answer is not none %}{{answer[21:]}}{% else %}{{answer_number|string}}{% endif %}'
7
+ doc_to_text: '{% if answer is not none %}{{question+"\nStep-by-Step Answer:"}}{% else %}{{"Question: "+question+"\nStep-by-Step Answer:"}}{% endif %}'
8
+ generation_kwargs:
9
+ do_sample: false
10
+ until:
11
+ - 'Question:'
12
+ - </s>
13
+ - <|im_end|>
14
+ metric_list:
15
+ - metric: exact_match
16
+ aggregation: mean
17
+ higher_is_better: true
18
+ ignore_case: true
19
+ ignore_punctuation: true
20
+ filter_list:
21
+ - name: "strict-match"
22
+ filter:
23
+ - function: "regex"
24
+ regex_pattern: "The answer is (\\-?[0-9\\.\\,]+)"
25
+ - function: "take_first"
26
+ - filter:
27
+ - function: regex
28
+ group_select: -1
29
+ regex_pattern: (-?[$0-9.,]{2,})|(-?[0-9]+)
30
+ - function: take_first
31
+ name: flexible-extract
32
+ metadata:
33
+ version: 2.0
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_zul.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: zul
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_zul_prompt_1
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_kin.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: kin
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_kin_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_lin.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: lin
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_lin_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_orm.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: orm
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_orm_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_sna.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: sna
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_sna_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_sot.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: sot
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_sot_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_swa.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: swa
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_swa_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_twi.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: twi
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_twi_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_vai.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: vai
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_vai_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_wol.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: wol
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_wol_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_xho.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: xho
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_xho_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_yaml ADDED
@@ -0,0 +1,33 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ tag: afrimgsm_tt_cot_tasks
2
+ dataset_path: masakhane/afrimgsm-translate-test
3
+ dataset_name: null # Overridden by language-specific config.
4
+ output_type: generate_until
5
+ test_split: test
6
+ doc_to_target: '{% if answer is not none %}{{answer[21:]}}{% else %}{{answer_number|string}}{% endif %}'
7
+ doc_to_text: 'Give direct numerical answers for the question provided. \n\nQuestion: {{question}} \Step-by-Step Answer: '
8
+ generation_kwargs:
9
+ do_sample: false
10
+ until:
11
+ - 'Question:'
12
+ - </s>
13
+ - <|im_end|>
14
+ metric_list:
15
+ - metric: exact_match
16
+ aggregation: mean
17
+ higher_is_better: true
18
+ ignore_case: true
19
+ ignore_punctuation: true
20
+ filter_list:
21
+ - name: "strict-match"
22
+ filter:
23
+ - function: "regex"
24
+ regex_pattern: "The answer is (\\-?[0-9\\.\\,]+)"
25
+ - function: "take_first"
26
+ - filter:
27
+ - function: regex
28
+ group_select: -1
29
+ regex_pattern: (-?[$0-9.,]{2,})|(-?[0-9]+)
30
+ - function: take_first
31
+ name: flexible-extract
32
+ metadata:
33
+ version: 2.0
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_yor.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: yor
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_yor_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_zul.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: zul
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_zul_prompt_2
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_amh.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: amh
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_amh_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_ewe.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: ewe
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_ewe_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_fra.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: fra
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_fra_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_hau.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: hau
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_hau_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_ibo.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: ibo
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_ibo_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_kin.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: kin
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_kin_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_lin.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: lin
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_lin_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_lug.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: lug
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_lug_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_orm.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: orm
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_orm_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_sna.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: sna
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_sna_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_sot.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: sot
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_sot_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_swa.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: swa
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_swa_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_twi.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: twi
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_twi_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_vai.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: vai
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_vai_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_wol.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: wol
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_wol_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_xho.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: xho
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_xho_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_yaml ADDED
@@ -0,0 +1,33 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ tag: afrimgsm_tt_cot_tasks
2
+ dataset_path: masakhane/afrimgsm-translate-test
3
+ dataset_name: null # Overridden by language-specific config.
4
+ output_type: generate_until
5
+ test_split: test
6
+ doc_to_target: '{% if answer is not none %}{{answer[21:]}}{% else %}{{answer_number|string}}{% endif %}'
7
+ doc_to_text: 'Solve the following math question \n\nQuestion: {{question}} \nStep-by-Step Answer: '
8
+ generation_kwargs:
9
+ do_sample: false
10
+ until:
11
+ - 'Question:'
12
+ - </s>
13
+ - <|im_end|>
14
+ metric_list:
15
+ - metric: exact_match
16
+ aggregation: mean
17
+ higher_is_better: true
18
+ ignore_case: true
19
+ ignore_punctuation: true
20
+ filter_list:
21
+ - name: "strict-match"
22
+ filter:
23
+ - function: "regex"
24
+ regex_pattern: "The answer is (\\-?[0-9\\.\\,]+)"
25
+ - function: "take_first"
26
+ - filter:
27
+ - function: regex
28
+ group_select: -1
29
+ regex_pattern: (-?[$0-9.,]{2,})|(-?[0-9]+)
30
+ - function: take_first
31
+ name: flexible-extract
32
+ metadata:
33
+ version: 2.0
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_yor.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: yor
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_yor_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_zul.yaml ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: zul
3
+ include: afrimgsm_cot_translate_yaml
4
+ task: afrimgsm_cot_translate_zul_prompt_3
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_amh.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: amh
3
+ doc_to_text: "Answer the given question with the step by step solution appropriate\
4
+ \ numerical value, ensuring that the response is clear and without any supplementary\
5
+ \ information. \n\nQuestion: {{question}} \nStep by step answer: "
6
+ include: afrimgsm_cot_translate_yaml
7
+ task: afrimgsm_cot_translate_amh_prompt_4
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_ewe.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: ewe
3
+ doc_to_text: "Answer the given question with the step by step solution appropriate\
4
+ \ numerical value, ensuring that the response is clear and without any supplementary\
5
+ \ information. \n\nQuestion: {{question}} \nStep by step answer: "
6
+ include: afrimgsm_cot_translate_yaml
7
+ task: afrimgsm_cot_translate_ewe_prompt_4
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_fra.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: fra
3
+ doc_to_text: "Answer the given question with the step by step solution appropriate\
4
+ \ numerical value, ensuring that the response is clear and without any supplementary\
5
+ \ information. \n\nQuestion: {{question}} \nStep by step answer: "
6
+ include: afrimgsm_cot_translate_yaml
7
+ task: afrimgsm_cot_translate_fra_prompt_4
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_hau.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: hau
3
+ doc_to_text: "Answer the given question with the step by step solution appropriate\
4
+ \ numerical value, ensuring that the response is clear and without any supplementary\
5
+ \ information. \n\nQuestion: {{question}} \nStep by step answer: "
6
+ include: afrimgsm_cot_translate_yaml
7
+ task: afrimgsm_cot_translate_hau_prompt_4
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_ibo.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: ibo
3
+ doc_to_text: "Answer the given question with the step by step solution appropriate\
4
+ \ numerical value, ensuring that the response is clear and without any supplementary\
5
+ \ information. \n\nQuestion: {{question}} \nStep by step answer: "
6
+ include: afrimgsm_cot_translate_yaml
7
+ task: afrimgsm_cot_translate_ibo_prompt_4
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_kin.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: kin
3
+ doc_to_text: "Answer the given question with the step by step solution appropriate\
4
+ \ numerical value, ensuring that the response is clear and without any supplementary\
5
+ \ information. \n\nQuestion: {{question}} \nStep by step answer: "
6
+ include: afrimgsm_cot_translate_yaml
7
+ task: afrimgsm_cot_translate_kin_prompt_4
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_lin.yaml ADDED
@@ -0,0 +1,7 @@
 
 
 
 
 
 
 
 
1
+ # Generated by utils.py
2
+ dataset_name: lin
3
+ doc_to_text: "Answer the given question with the step by step solution appropriate\
4
+ \ numerical value, ensuring that the response is clear and without any supplementary\
5
+ \ information. \n\nQuestion: {{question}} \nStep by step answer: "
6
+ include: afrimgsm_cot_translate_yaml
7
+ task: afrimgsm_cot_translate_lin_prompt_4