inference-optimization/Qwen3-235B-A22B-Thinking-2507-quantized.w4a16 Text Generation • 32B • Updated May 20 • 10
nwzjk/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16-W4A16-G128 Text Generation • 565B • Updated Jun 8 • 8 • 1
drowzeys/keys-latest-GLM-5.2-Quantrio-INT4-INT8-Mixed-Abliterated-DFlash Text Generation • 785B • Updated 26 days ago • 245 • 4