Qwen-Image 2.1 提示词增强节点提速 4.4 倍,8GB 显存可跑
mozophe · reddit · 2026-10-01
作者更新了其 ComfyUI 自定义节点,把 Qwen-Image 2.1 官方提示词增强器整合进工作流,新增 llama.cpp 后端并配合 MTP head 与量化:
- 在 RTX 4090 Laptop(16GB)上,图生文从基线 23.5 tok/s 提升至 63.2 tok/s(约 2.69 倍),双图编辑场景从 19.4 提升到 85.2 tok/s(约 4.39 倍)
- Q4KM 量化下最低 8GB 显存即可运行,Q80 无明显质量损失;压缩 llama.cpp 后 maxlength 对速度影响很小
- 首次使用自动下载 llama-server 与 GGUF 模型;保留 ComfyUI 后端兼容 AMD/Intel/Mac
- 附带同种子对比:增强器对图内文字、复杂场景和多步编辑帮助最大
- 另提供 Heretic 去审查版 GGUF
项目地址:github.com/mozophe/ComfyUI-Qwen-Image-2.1-PromptEnhancer-MTP
「Infra」频道最新
- Gradium 发布最快 TTS:首段音频延迟仅约 50ms — mattturck · 2026-10-02
- 工程师观察:Gemini 4 Argon 正被用于跨数据中心集群优化 — rakyll · 2026-10-02
- Aleph Alpha 公开 MoE 预训练心得:16 到 512 块 B200 近线性扩展 — CatAstro_Piyush · 2026-10-02
- HBM 将吞下 22% DRAM 晶圆,内存成 AI 算力的最短板 — aronchick · 2026-10-02
- 视频解析:Google 的 AI 芯片能否击败 Nvidia? — Ill_Vegetable169 · 2026-10-02
- GB300 NVL72 实测:仅调 FP8 KV cache 与 GPU 分配,吞吐最高提升 64% — ryanshrout · 2026-10-02