开源 ComfyUI 节点给 Qwen-Image 2.1 提示词增强提速至 1.7 倍
mozophe · reddit · 2026-09-25
作者发现 ComfyUI 里 Qwen-Image 2.1 的官方 prompt enhancer(Qwen3.5-9B 微调版)生成很慢,因为 checkpoint 不带 MTP 头。他给模型挂上 MTP 头后速度显著提升(RTX 4090 Laptop 16GB 实测):
- Text-to-image: 35→47 tok/s(1.36×),editing: 31→52 tok/s(1.65×)
- 与官方 maxlength 的 checkpoint 比,MTP + maxlength 8192 在 t2i 快 1.7×、editing 快 2.5×
- 质量不变,但同 seed 输出文本与原 checkpoint 不同
由于 ComfyUI 需要 MTP 专属修复才能处理 Qwen 3.5 的图像输入,作者写了自定义节点并开源:ComfyUI-Qwen-Image-2.1-PromptEnhancer-MTP
要点:
- 需 ComfyUI v0.37.0+,建议 16GB 显存 + 32GB 内存,峰值显存 t2i 约 14GB、editing 约 16GB
- 首次使用时自动下载并挂 MTP 头;使用 Qwen 官方系统提示与采样参数
- 附带 heretic(去审查)版本,提速相同
- 支持最多 10 张输入图编辑;提示词与推理过程分开输出;含示例工作流 PNG/JSON
「Infra」频道最新
- Meta 发布 Muse Realtime Avatars,实时视频生成推理栈成核心难点 — ukhndlwl · 2026-09-25
- 高盛大幅上调 AI 算力预测:2030 全球数据中心容量升至 217GW — McDonaghMatthew · 2026-09-25
- 4400 美元在 RTX 5090 上预训练出媲美 Qwen2-1.5B 的开源 2B 模型 — IgorCarron · 2026-09-25
- YC 系 Prism 推出开源 LLM 推理云,DeepSeek V4.1 Flash 达 547 tok/s — ycombinator · 2026-09-25
- 押注未来三年:他自建本地推理栈,双 5060 Ti 跑出 100 tok/s — No-Name-Person111 · 2026-09-25
- 谷歌 Suncatcher 计划:太阳能供能的太空 AI 数据中心 — The Decoder · 2026-09-25