neopolita/Qwen3.8-Flash-Next-99B-A5B-Niwaki-3bit-mlx Text Generation • 73B • Updated 5 days ago • 2.28k • 5
Local SOTA for RAM Poor Mac users Collection High quality low-bit BaseQuant_XL for 16 ~ 32 GB M-base-chip Macs (Mac Mini, MacBook Air, base MacBook Pro): bf16 routing, 8-bit attn, MoE arch. • 8 items • Updated 14 days ago • 2
Local SOTA for RAM Poor Mac users Collection High quality low-bit BaseQuant_XL for 16 ~ 32 GB M-base-chip Macs (Mac Mini, MacBook Air, base MacBook Pro): bf16 routing, 8-bit attn, MoE arch. • 8 items • Updated 14 days ago • 2
Local SOTA for 48GB Macs Collection Best local MLX-quantized LLMs fitting 48GB unified memory. 6-bit XL variants are data-agnostic honest kings; oQ4e-XL for RAM-desperate coders. • 9 items • Updated 15 days ago • 2
Local SOTA for RAM Poor Mac users Collection High quality low-bit BaseQuant_XL for 16 ~ 32 GB M-base-chip Macs (Mac Mini, MacBook Air, base MacBook Pro): bf16 routing, 8-bit attn, MoE arch. • 8 items • Updated 14 days ago • 2