torchao INT8/FP8 weight-only quantized MiniMax-H3 (video+audio omni) for consumer GPUs. Group-offload recipe; load with diffusers (main) + torchao.
Chohan
abhishekchohan
AI & ML interests
None yet
Recent Activity
updated a model about 13 hours ago
abhishekchohan/Muse-Glimmer-30B-GPTQ-INT4 published a model about 13 hours ago
abhishekchohan/Muse-Glimmer-30B-GPTQ-INT4 updated a collection 3 days ago
MiniMax-H3 — INT8 & FP8 Quantizations (torchao)Organizations
None yet