Krea 2 的 SVDQuant 量化版在 ComfyUI 上提速约 2 倍
LightAppropriate624 · reddit · 2026-07-25
这是一个面向 Krea 2 的社区量化项目:作者把 checkpoint 做成了 INT8 / W4A4 版本,接入 ComfyUI 后号称可在质量几乎不塌的前提下获得 最高约 2 倍加速。
- 作者强调,网上常见的 FP8 方案只有在原生支持 FP8 tensor core 的 GPU 上才真正有用;在老卡上可能会被转回 bf16,甚至比直接 bf16 还慢。
- 他们把重点放在更早就支持的 INT8 和 W4A4 上,覆盖到 Turing / RTX 20 系列。
- 在 RTX 3090、1024×1024、8 steps 的测试里,bf16 warm run 约 21.3 秒,而 W4A4 版本 warm run 约 10.1–10.2 秒。
- 项目还顺手修了一个 ComfyUI 的 LoRA 加载问题:默认 loader 在这类量化模型上只会给大约 12% 的层打补丁,新 loader 则能覆盖完整网络。
- 这是一个社区项目,与 Krea 无官方关系。
所属事件:Krea 2 量化版接入 ComfyUI 推理提速超 2 倍(2 条相关)→
「Infra」频道最新
- 本地 Qwen 模型驱动机械臂测试 78 款手机续航 — gappyvalley · 2026-07-27
- MiniBot 2.40 新增 xAI、HF Studio 和 vLLM 支持 — Creative-Type9411 · 2026-07-27
- 苹果智能眼镜、英伟达SK合作与携程51.79亿罚单汇总 — APPSO · 2026-07-27
- DeepSeek 融资传闻、欧盟 AI 透明度规则与 OpenAI 安全事故 — 创业邦 · 2026-07-27
- QuixiCore 主张原生量化内核取代先反量化再执行 — QuixiAI · 2026-07-27
- Nvidia 被曝洽谈为 OpenAI 俄亥俄数据中心提供 2500 亿美元背书 — Wonderful_Buffalo_32 · 2026-07-27