Socratic AI Tutoring (SFT + DPO) Collection Aligned open language models (Llama-3.1-8B and Muse-Glimmer-30B) and multi-domain pedagogical preference dataset (1,680 items) for AI education. • 3 items • Updated 9 days ago
Socratic AI Tutoring (SFT + DPO) Collection Aligned open language models (Llama-3.1-8B and Muse-Glimmer-30B) and multi-domain pedagogical preference dataset (1,680 items) for AI education. • 3 items • Updated 9 days ago
Socratic AI Tutoring (SFT + DPO) Collection Aligned open language models (Llama-3.1-8B and Muse-Glimmer-30B) and multi-domain pedagogical preference dataset (1,680 items) for AI education. • 3 items • Updated 9 days ago