Add files using upload-large-folder tool
Browse filesThis view is limited to 50 files because it contains too many changes. See raw diff
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_5/afrimgsm_translate_sot.yaml +7 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_5/afrimgsm_translate_zul.yaml +6 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_ewe.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_ibo.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_lin.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_sna.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_twi.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_vai.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_wol.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_yaml +33 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_zul.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_kin.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_lin.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_orm.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_sna.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_sot.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_swa.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_twi.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_vai.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_wol.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_xho.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_yaml +33 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_yor.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_zul.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_amh.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_ewe.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_fra.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_hau.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_ibo.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_kin.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_lin.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_lug.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_orm.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_sna.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_sot.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_swa.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_twi.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_vai.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_wol.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_xho.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_yaml +33 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_yor.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_zul.yaml +4 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_amh.yaml +7 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_ewe.yaml +7 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_fra.yaml +7 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_hau.yaml +7 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_ibo.yaml +7 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_kin.yaml +7 -0
- lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_lin.yaml +7 -0
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_5/afrimgsm_translate_sot.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: sot
|
| 3 |
+
doc_to_text: "For mathematical questions provided in Sesotho language. Supply the\
|
| 4 |
+
\ accurate numeric answer to the provided question. \n\nQuestion: {{question}} \n\
|
| 5 |
+
Answer: "
|
| 6 |
+
include: afrimgsm_translate_yaml
|
| 7 |
+
task: afrimgsm_translate_sot_prompt_5
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate/prompt_5/afrimgsm_translate_zul.yaml
ADDED
|
@@ -0,0 +1,6 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: zul
|
| 3 |
+
doc_to_text: "For mathematical questions provided in Zulu language. Supply the accurate\
|
| 4 |
+
\ numeric answer to the provided question. \n\nQuestion: {{question}} \nAnswer: "
|
| 5 |
+
include: afrimgsm_translate_yaml
|
| 6 |
+
task: afrimgsm_translate_zul_prompt_5
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_ewe.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: ewe
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_ewe_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_ibo.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: ibo
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_ibo_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_lin.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: lin
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_lin_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_sna.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: sna
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_sna_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_twi.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: twi
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_twi_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_vai.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: vai
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_vai_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_wol.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: wol
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_wol_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_yaml
ADDED
|
@@ -0,0 +1,33 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
tag: afrimgsm_tt_cot_tasks
|
| 2 |
+
dataset_path: masakhane/afrimgsm-translate-test
|
| 3 |
+
dataset_name: null # Overridden by language-specific config.
|
| 4 |
+
output_type: generate_until
|
| 5 |
+
test_split: test
|
| 6 |
+
doc_to_target: '{% if answer is not none %}{{answer[21:]}}{% else %}{{answer_number|string}}{% endif %}'
|
| 7 |
+
doc_to_text: '{% if answer is not none %}{{question+"\nStep-by-Step Answer:"}}{% else %}{{"Question: "+question+"\nStep-by-Step Answer:"}}{% endif %}'
|
| 8 |
+
generation_kwargs:
|
| 9 |
+
do_sample: false
|
| 10 |
+
until:
|
| 11 |
+
- 'Question:'
|
| 12 |
+
- </s>
|
| 13 |
+
- <|im_end|>
|
| 14 |
+
metric_list:
|
| 15 |
+
- metric: exact_match
|
| 16 |
+
aggregation: mean
|
| 17 |
+
higher_is_better: true
|
| 18 |
+
ignore_case: true
|
| 19 |
+
ignore_punctuation: true
|
| 20 |
+
filter_list:
|
| 21 |
+
- name: "strict-match"
|
| 22 |
+
filter:
|
| 23 |
+
- function: "regex"
|
| 24 |
+
regex_pattern: "The answer is (\\-?[0-9\\.\\,]+)"
|
| 25 |
+
- function: "take_first"
|
| 26 |
+
- filter:
|
| 27 |
+
- function: regex
|
| 28 |
+
group_select: -1
|
| 29 |
+
regex_pattern: (-?[$0-9.,]{2,})|(-?[0-9]+)
|
| 30 |
+
- function: take_first
|
| 31 |
+
name: flexible-extract
|
| 32 |
+
metadata:
|
| 33 |
+
version: 2.0
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_1/afrimgsm_cot_translate_zul.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: zul
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_zul_prompt_1
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_kin.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: kin
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_kin_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_lin.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: lin
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_lin_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_orm.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: orm
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_orm_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_sna.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: sna
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_sna_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_sot.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: sot
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_sot_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_swa.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: swa
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_swa_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_twi.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: twi
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_twi_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_vai.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: vai
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_vai_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_wol.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: wol
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_wol_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_xho.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: xho
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_xho_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_yaml
ADDED
|
@@ -0,0 +1,33 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
tag: afrimgsm_tt_cot_tasks
|
| 2 |
+
dataset_path: masakhane/afrimgsm-translate-test
|
| 3 |
+
dataset_name: null # Overridden by language-specific config.
|
| 4 |
+
output_type: generate_until
|
| 5 |
+
test_split: test
|
| 6 |
+
doc_to_target: '{% if answer is not none %}{{answer[21:]}}{% else %}{{answer_number|string}}{% endif %}'
|
| 7 |
+
doc_to_text: 'Give direct numerical answers for the question provided. \n\nQuestion: {{question}} \Step-by-Step Answer: '
|
| 8 |
+
generation_kwargs:
|
| 9 |
+
do_sample: false
|
| 10 |
+
until:
|
| 11 |
+
- 'Question:'
|
| 12 |
+
- </s>
|
| 13 |
+
- <|im_end|>
|
| 14 |
+
metric_list:
|
| 15 |
+
- metric: exact_match
|
| 16 |
+
aggregation: mean
|
| 17 |
+
higher_is_better: true
|
| 18 |
+
ignore_case: true
|
| 19 |
+
ignore_punctuation: true
|
| 20 |
+
filter_list:
|
| 21 |
+
- name: "strict-match"
|
| 22 |
+
filter:
|
| 23 |
+
- function: "regex"
|
| 24 |
+
regex_pattern: "The answer is (\\-?[0-9\\.\\,]+)"
|
| 25 |
+
- function: "take_first"
|
| 26 |
+
- filter:
|
| 27 |
+
- function: regex
|
| 28 |
+
group_select: -1
|
| 29 |
+
regex_pattern: (-?[$0-9.,]{2,})|(-?[0-9]+)
|
| 30 |
+
- function: take_first
|
| 31 |
+
name: flexible-extract
|
| 32 |
+
metadata:
|
| 33 |
+
version: 2.0
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_yor.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: yor
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_yor_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_2/afrimgsm_cot_translate_zul.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: zul
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_zul_prompt_2
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_amh.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: amh
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_amh_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_ewe.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: ewe
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_ewe_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_fra.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: fra
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_fra_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_hau.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: hau
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_hau_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_ibo.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: ibo
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_ibo_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_kin.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: kin
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_kin_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_lin.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: lin
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_lin_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_lug.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: lug
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_lug_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_orm.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: orm
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_orm_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_sna.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: sna
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_sna_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_sot.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: sot
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_sot_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_swa.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: swa
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_swa_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_twi.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: twi
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_twi_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_vai.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: vai
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_vai_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_wol.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: wol
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_wol_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_xho.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: xho
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_xho_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_yaml
ADDED
|
@@ -0,0 +1,33 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
tag: afrimgsm_tt_cot_tasks
|
| 2 |
+
dataset_path: masakhane/afrimgsm-translate-test
|
| 3 |
+
dataset_name: null # Overridden by language-specific config.
|
| 4 |
+
output_type: generate_until
|
| 5 |
+
test_split: test
|
| 6 |
+
doc_to_target: '{% if answer is not none %}{{answer[21:]}}{% else %}{{answer_number|string}}{% endif %}'
|
| 7 |
+
doc_to_text: 'Solve the following math question \n\nQuestion: {{question}} \nStep-by-Step Answer: '
|
| 8 |
+
generation_kwargs:
|
| 9 |
+
do_sample: false
|
| 10 |
+
until:
|
| 11 |
+
- 'Question:'
|
| 12 |
+
- </s>
|
| 13 |
+
- <|im_end|>
|
| 14 |
+
metric_list:
|
| 15 |
+
- metric: exact_match
|
| 16 |
+
aggregation: mean
|
| 17 |
+
higher_is_better: true
|
| 18 |
+
ignore_case: true
|
| 19 |
+
ignore_punctuation: true
|
| 20 |
+
filter_list:
|
| 21 |
+
- name: "strict-match"
|
| 22 |
+
filter:
|
| 23 |
+
- function: "regex"
|
| 24 |
+
regex_pattern: "The answer is (\\-?[0-9\\.\\,]+)"
|
| 25 |
+
- function: "take_first"
|
| 26 |
+
- filter:
|
| 27 |
+
- function: regex
|
| 28 |
+
group_select: -1
|
| 29 |
+
regex_pattern: (-?[$0-9.,]{2,})|(-?[0-9]+)
|
| 30 |
+
- function: take_first
|
| 31 |
+
name: flexible-extract
|
| 32 |
+
metadata:
|
| 33 |
+
version: 2.0
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_yor.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: yor
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_yor_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_3/afrimgsm_cot_translate_zul.yaml
ADDED
|
@@ -0,0 +1,4 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: zul
|
| 3 |
+
include: afrimgsm_cot_translate_yaml
|
| 4 |
+
task: afrimgsm_cot_translate_zul_prompt_3
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_amh.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: amh
|
| 3 |
+
doc_to_text: "Answer the given question with the step by step solution appropriate\
|
| 4 |
+
\ numerical value, ensuring that the response is clear and without any supplementary\
|
| 5 |
+
\ information. \n\nQuestion: {{question}} \nStep by step answer: "
|
| 6 |
+
include: afrimgsm_cot_translate_yaml
|
| 7 |
+
task: afrimgsm_cot_translate_amh_prompt_4
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_ewe.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: ewe
|
| 3 |
+
doc_to_text: "Answer the given question with the step by step solution appropriate\
|
| 4 |
+
\ numerical value, ensuring that the response is clear and without any supplementary\
|
| 5 |
+
\ information. \n\nQuestion: {{question}} \nStep by step answer: "
|
| 6 |
+
include: afrimgsm_cot_translate_yaml
|
| 7 |
+
task: afrimgsm_cot_translate_ewe_prompt_4
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_fra.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: fra
|
| 3 |
+
doc_to_text: "Answer the given question with the step by step solution appropriate\
|
| 4 |
+
\ numerical value, ensuring that the response is clear and without any supplementary\
|
| 5 |
+
\ information. \n\nQuestion: {{question}} \nStep by step answer: "
|
| 6 |
+
include: afrimgsm_cot_translate_yaml
|
| 7 |
+
task: afrimgsm_cot_translate_fra_prompt_4
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_hau.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: hau
|
| 3 |
+
doc_to_text: "Answer the given question with the step by step solution appropriate\
|
| 4 |
+
\ numerical value, ensuring that the response is clear and without any supplementary\
|
| 5 |
+
\ information. \n\nQuestion: {{question}} \nStep by step answer: "
|
| 6 |
+
include: afrimgsm_cot_translate_yaml
|
| 7 |
+
task: afrimgsm_cot_translate_hau_prompt_4
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_ibo.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: ibo
|
| 3 |
+
doc_to_text: "Answer the given question with the step by step solution appropriate\
|
| 4 |
+
\ numerical value, ensuring that the response is clear and without any supplementary\
|
| 5 |
+
\ information. \n\nQuestion: {{question}} \nStep by step answer: "
|
| 6 |
+
include: afrimgsm_cot_translate_yaml
|
| 7 |
+
task: afrimgsm_cot_translate_ibo_prompt_4
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_kin.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: kin
|
| 3 |
+
doc_to_text: "Answer the given question with the step by step solution appropriate\
|
| 4 |
+
\ numerical value, ensuring that the response is clear and without any supplementary\
|
| 5 |
+
\ information. \n\nQuestion: {{question}} \nStep by step answer: "
|
| 6 |
+
include: afrimgsm_cot_translate_yaml
|
| 7 |
+
task: afrimgsm_cot_translate_kin_prompt_4
|
lm-evaluation-harness/lm_eval/tasks/afrimgsm/translate_cot/prompt_4/afrimgsm_cot_translate_lin.yaml
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
# Generated by utils.py
|
| 2 |
+
dataset_name: lin
|
| 3 |
+
doc_to_text: "Answer the given question with the step by step solution appropriate\
|
| 4 |
+
\ numerical value, ensuring that the response is clear and without any supplementary\
|
| 5 |
+
\ information. \n\nQuestion: {{question}} \nStep by step answer: "
|
| 6 |
+
include: afrimgsm_cot_translate_yaml
|
| 7 |
+
task: afrimgsm_cot_translate_lin_prompt_4
|