Nemotron 3 MLX Quantizations
MLX-LM affine quantizations for Nemotron 3; see each model card for details.
Text Generation • 121B • Updated • 85Note 4-bit MLX-LM affine quantization of nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16. No comparative benchmarks yet.
DreamFoundries/NVIDIA-Nemotron-3-Super-120B-A12B-BF16-6bit
Text Generation • 121B • Updated • 93Note 6-bit MLX-LM affine quantization of nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16. No comparative benchmarks yet.
DreamFoundries/NVIDIA-Nemotron-3-Super-120B-A12B-BF16-8bit
Text Generation • 121B • Updated • 93Note 8-bit MLX-LM affine quantization of nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16. No comparative benchmarks yet.
DreamFoundries/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16-4bit
Text Generation • 32B • Updated • 28Note 4-bit MLX-LM affine quantization of nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16. No comparative benchmarks yet.
DreamFoundries/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16-6bit
Text Generation • 32B • Updated • 29Note 6-bit MLX-LM affine quantization of nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16. No comparative benchmarks yet.
DreamFoundries/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16-8bit
Text Generation • 32B • Updated • 40Note 8-bit MLX-LM affine quantization of nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16. No comparative benchmarks yet.