Nunchaku Lite 在 Diffusers 中显存减半、图像生成快 30%
RisingSayak · x · 2026-07-24
Nunchaku Lite 让大图像模型更容易跑起来
- 这次更新是 SVDQuant 4-bit(W4A4)扩散推理,并且已经 原生接入 Diffusers。
- 作者称它能把 峰值显存最高降低 50%,同时让生成速度提升约 30%,且没有明显破坏图像质量。
- 配图里的例子显示,峰值显存从 31.1 GB 降到 16.0 GB,端到端耗时从 3.00s 缩到 1.68s。
- 实际意义是:原本需要更高显存的图像模型,现在能在更多 GPU 上实用化运行。
「Infra」频道最新
- 中国 AI 资金叙事转向数据中心与抵押品逻辑 — sankin_eth · 2026-07-24
- 爆料称 MI500 上光互联,关键指标压过 Rubin Ultra — zephyr_z9 · 2026-07-24
- AI 治理话题降温,自动化和数据底座仍在升温 — YvesMulkers · 2026-07-24
- 8 美元 ESP32-S3 已能离线跑 2890 万参数模型 — brianrkelly · 2026-07-24
- NVIDIA 发布面向检索的多语言 1B embedding 模型 — tomaarsen · 2026-07-24
- AI ETF 贴文称市场已提前定价 Qualcomm 与 AMD 等事件 — alejandroll10 · 2026-07-24