·
AI & ML interests
None yet
Organizations
Kyleyee/imdb_for_sft_7b_all
Viewer
• Updated • 25k • 43
Kyleyee/imdb_with_2_responses_sft_eval
Viewer
• Updated • 25k • 13
Kyleyee/imdb_with_8_responses_dpo_eval
Viewer
• Updated • 25k • 13
Kyleyee/imdb_with_8_responses_dpo
Viewer
• Updated • 25k • 11
Kyleyee/train_data_imdb_for_DPO_7b_all
Viewer
• Updated • 26k • 13
Kyleyee/train_data_imdb_for_DPO_7b
Viewer
• Updated • 6.5k • 15
Kyleyee/eval_data_hh_all_reformed_v2
Viewer
• Updated • 11.8k • 32
Kyleyee/eval_data_hh_all_reformed
Viewer
• Updated • 11.8k • 30
Kyleyee/reward_distribuction_tldr
Viewer
• Updated • 179k • 15
Kyleyee/reward_distribuction
Viewer
• Updated • 46.2k • 32
Kyleyee/reward_distribuction_test
Viewer
• Updated • 64 • 7
Kyleyee/eval_set_hh_7b_dpo_true_new
Viewer
• Updated • 11.8k • 34
Kyleyee/train_data_Helpful_drdpo_preference_7b_sft_1e
Viewer
• Updated • 46.2k • 88
Kyleyee/train_data_Helpful_drdpo_7b_sft_1e
Viewer
• Updated • 46.2k • 11
Kyleyee/train_data_Helpful_drdpo_preference_7b_075
Viewer
• Updated • 46.2k • 12
Kyleyee/train_data_Helpful_drdpo_7b_075
Viewer
• Updated • 46.2k • 32
Kyleyee/eval_set_hh_7b_dpo_true
Viewer
• Updated • 11.8k • 25
Kyleyee/train_data_Helpful_drdpo_preference
Viewer
• Updated • 46.2k • 13
Kyleyee/train_data_Helpful_drdpo_7b
Viewer
• Updated • 46.2k • 51
Viewer
• Updated • 11.8k • 59
Kyleyee/eval_effect_hh_7b
Viewer
• Updated • 11.8k • 12
Kyleyee/evaluate-dataset-HH-7b
Viewer
• Updated • 11.8k • 74
Kyleyee/eval_effect_hh_drdpo_7b_merged
Viewer
• Updated • 11.8k • 9
Kyleyee/evaluate-dataset-HH-Base
Viewer
• Updated • 11.8k • 8
Kyleyee/evaluate-dataset-HH-Instruct
Viewer
• Updated • 11.8k • 77
Kyleyee/eval_effect_hh_7b_500
Viewer
• Updated • 500 • 11
Kyleyee/imdb_data_for_dr_test_8sample_PAD_FIX
Viewer
• Updated • 10k • 8
Kyleyee/imdb_data_for_dr_test_8sample_gpt_neo
Viewer
• Updated • 10k • 11
Kyleyee/imdb_data_for_true_preference_gpt-neoo
Viewer
• Updated • 25k • 14
Kyleyee/train_data_imdb_for_target_policy_dpo
Viewer
• Updated • 26k • 17