ComfyUI INT4量化模型合集
Winougan · reddit · 2026-07-12
作者在 Hugging Face 上上传了一批 INT4 量化的 ComfyUI 模型,并提供工作流和样例,强调“免费可用”。
主要信息
- 目标是让模型在更低显存下运行,作者称在 RTX 3070 Ti 和 RTX 4090 上都测试可用。
- 推荐搭配更新的环境:ComfyUI nightly、PyTorch 2.12、Python 3.13、cu132、Triton 3.8、FlashAttention 2、SageAttention 2。
- 性能上,作者声称:
- INT8 相比 BF16 提升约 25%;
- INT4 提升约 40%–50%。
- 画质上,作者认为 INT8 几乎等同 BF16,INT4 也能接近 FP8。
已上传/将上传
- 已上传:SeedVR 7b INT4、Gemma 3 12b INT4、Sulphur 2 Base INT4。
- 计划继续上传:Krea 2 Turbo、Klein9b、Z-Image Turbo、部分 Illustrious XL 模型,以及更多自定义微调版本。
所属事件:多款图像模型完成INT4量化以降低显存门槛(2 条相关)→
「Infra」频道最新
- 影子算力市场走向台前,Meta 对外出售过剩 GPU 算力成标志性信号 — DavidLinthicum · 2026-09-11
- Engram 随机读取不适合 SSD,CPU 内存低延迟共享或成正解 — bookwormengr · 2026-09-11
- 劝退帖:推理工程是真金白银的硬活,八成尝鲜者已悄然放弃 — abhijithneil · 2026-09-11
- Hugging Face《Ultra Scale Playbook》:GPU 集群训练 LLM 的免费技术书 — mdancho84 · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- 推理服务关键指标盘点:流式速度 TPOT 与可用性如何影响体验 — abhijithneil · 2026-09-11