view article Article Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel nvidia • Jun 24 • 41
Embarrassingly Simple Self-Distillation Improves Code Generation Paper • 2604.01193 • Published Apr 1 • 56
Austin362667/Qwen3-0.6B-MLX-bf16-python-18k-alpaca Text Generation • 0.6B • Updated Mar 16 • 22
Austin362667/Qwen3-0.6B-MLX-bf16-python-5k-alpaca-resampled-Qwen-4B Text Generation • 0.6B • Updated Mar 16 • 25
Austin362667/Qwen3-0.6B-MLX-bf16-python-5k-alpaca-resampled-Qwen-4B Text Generation • 0.6B • Updated Mar 16 • 25
Austin362667/python_code_instructions_5k_alpaca_qwen3_4B_resampled Viewer • Updated Mar 15 • 5k • 12
Austin362667/python_code_instructions_5k_alpaca_qwen3_4B_resampled Viewer • Updated Mar 15 • 5k • 12
Austin362667/Qwen3-0.6B-MLX-bf16-python-18k-alpaca Text Generation • 0.6B • Updated Mar 16 • 22