torchao INT8/FP8 weight-only quantized MiniMax-H3 (video+audio omni) for consumer GPUs. Group-offload recipe; load with diffusers (main) + torchao.
Chohan
abhishekchohan
AI & ML interests
None yet
Recent Activity
updated a model 5 days ago
abhishekchohan/Qwen3.8-27B-GPTQ-INT4 published a model 5 days ago
abhishekchohan/Qwen3.8-27B-GPTQ-INT4 updated a model 8 days ago
abhishekchohan/Muse-Glimmer-30B-GPTQ-INT4Organizations
None yet