Final scaled models from "Reasoning Through Chess: How Reasoning Evolves from Data Through Fine-Tuning and Reinforcement Learning".
Lucas Dionisopoulos
lucasdino
AI & ML interests
None yet
Organizations
None yet
models 8
lucasdino/Qwen2.5-7B-Chess-FactualBoardAnswering-SmallTrain-SFT
8B • Updated • 2
lucasdino/Qwen2.5-7B-Chess-FactualBoardAnswering-SmallTrain-RL
8B • Updated • 3
lucasdino/Qwen2.5-7B-Chess-BestMoveBestLine-RL
8B • Updated • 11 • 1
lucasdino/Qwen2.5-7B-Chess-BestMove-RL
8B • Updated • 67 • 1
lucasdino/Qwen2.5-7B-Chess-BestLine-RL
8B • Updated • 12 • 1
lucasdino/Qwen2.5-7B-Chess-BestMoveBestLine-SFT
8B • Updated • 5 • 1
lucasdino/Qwen2.5-7B-Chess-BestMove-SFT
8B • Updated • 4 • 1
lucasdino/Qwen2.5-7B-Chess-BestLine-SFT
8B • Updated • 4 • 1