Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090 Paper • 2608.27370 • Published 30 days ago • 40
Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090 Paper • 2608.27370 • Published 30 days ago • 40
CPM: A Large-scale Generative Chinese Pre-trained Language Model Paper • 2012.00413 • Published Dec 1, 2020
CPM-2: Large-scale Cost-effective Pre-trained Language Models Paper • 2106.10715 • Published Jun 20, 2021 • 1