πŸš€ supreme-draft-0.5b

supreme-draft-0.5b is the ultra-fast 0.5B Speculative Draft Model for SupremeAI 2.0. Designed to accelerate inference speed by up to 2.5x via speculative decoding. Merged via DARE-TIES using Qwen2.5-0.5B-Instruct and Qwen2.5-0.5B.

Downloads last month
17
Safetensors
Model size
0.5B params
Tensor type
BF16
Β·
Inference Providers NEW
This model isn't deployed by any Inference Provider. πŸ™‹ Ask for provider support

Model tree for njelltd4/supreme-draft-0.5b

Finetuned
(919)
this model