Qwen Image 2.1 量化实测:Int4 反而比 FP4 差,速度翻倍但有画质代价
mesmerlord · reddit · 2026-09-22
开发者用 Astra 剩余额度把新出的 Qwen Image 2.1 做了量化,尝试复刻自己付费工具基于 Flux klein + nunchaku 的 serverless 方案,模型已传到 HuggingFace(Mesmer-Image-21-Nunchaku)。
要点:
- 第一版 int8 转换体积远超预期(约 9GB),而 int4/fp4 版本约 4.8GB
- 速度约 2 倍,但画质有损:文字保留尚可,背景人脸(尤其 40 steps 时)受损较明显,25 steps 表现更好;图表类图像效果较差
- 对比基准(BF16 全精度、FP4 适用 50xx 卡、INT4 适用 40xx 及以下)见 mesmer.tools/benchmarks/qwen-image-2-1
- 结论:INT4 比 FP4 更差,50xx 卡用户建议走 FP4 路线
- 作者提示:有 coding agent 的话可以自己复现整套流程,不必等别人发
「Infra」频道最新
- Rackspace 加入 NVIDIA 云伙伴计划,押注受监管行业全栈 AI 运维 — DavidLinthicum · 2026-09-22
- LuaJIT UDF 把 LLM 决策读出嵌进 DuckDB:零 token 概率分类进 SQL — Shoddy_Telephone9702 · 2026-09-22
- Nvidia 推出 DSX Ready 认证 AI 工厂供电散热,Tesla、LG 首批入列 — emmanuelvivier · 2026-09-22
- 开源 ContextBridge:让任务自己找算力,打通本地机、API 与共享主机 — IamAngusU · 2026-09-22
- 自动研究智能体 SENPAI 自写内核,训练时长从 26 小时降到 22 小时 — morgymcg · 2026-09-22
- 2x3090 跑 Qwen3.8-27B:单流 70 tok/s、262k 满上下文 — maqifrnswa · 2026-09-22