OpenFineTrain Collection Very fine 55 trillion+ tokens worth of ungated huggingface datasets for LLM training across 80+ datasets. • 90 items • Updated 7 days ago • 2
ReasoningTune Collection Great datasets for finetuning on reasoning traces. • 1 item • Updated 5 days ago • 1