Kijai 发布 MiniMax H3 4-bit 量化版,低显存也能跑
CurrentNew1039 · reddit · 2026-08-08
开发者 Kijai 为 MiniMax H3 实验版模型推出了 w4a8 混合精度的 4-bit 量化版本。该版本在保持与 int 8 相当甚至更快运行速度的同时,大幅降低了对显存和内存的占用需求,非常适合 8GB 显存及以下的设备。
目前该模型已在 Hugging Face 上开源,其中主模型文件体积约 11.8-12.5GB。此外,还附带了一个体积仅为 2.9GB 的 int 8 convrot 视频 VAE(原 fp16 版本为 4.9GB)。用户需将 ComfyUI 更新至最新版方可正常使用。
「Infra」频道最新
- Inflect 推出免费 AI 爬虫索引,追踪各家大模型抓取行为 — Scobleizer · 2026-08-08
- 端侧 AI 硬件为何难产?小模型专用芯片落地阻碍探讨 — Waste-Intention-2806 · 2026-08-08
- NVIDIA不会推消费级高显存GPU,推理加速器或成主流 — mike64_t · 2026-08-08
- 日本化学巨头垄断电子束核心材料,对华半导体形成关键卡脖子 — PAstynome · 2026-08-08
- Cloudflare开源Computer:为AI智能体提供持久化虚拟文件系统 — bibryam · 2026-08-08
- SGLang 推理性能剖析实战:定位生产环境瓶颈 — BanghuaZ · 2026-08-08