Kijai 发布 MiniMax H3 4-bit 量化版,低显存也能跑

CurrentNew1039 · reddit · 2026-08-08

开发者 Kijai 为 MiniMax H3 实验版模型推出了 w4a8 混合精度的 4-bit 量化版本。该版本在保持与 int 8 相当甚至更快运行速度的同时,大幅降低了对显存和内存的占用需求,非常适合 8GB 显存及以下的设备。

目前该模型已在 Hugging Face 上开源,其中主模型文件体积约 11.8-12.5GB。此外,还附带了一个体积仅为 2.9GB 的 int 8 convrot 视频 VAE(原 fp16 版本为 4.9GB)。用户需将 ComfyUI 更新至最新版方可正常使用。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →