Qwen 图像编辑 CLIP 编码提速 7.6 倍:AMD 用户靠 AI 搞定内存补丁

kalexan94 · reddit · 2026-10-10

一位 AMD 7900XTX 用户用 AI 辅助编程为 ComfyUI 写了自定义节点,把 Qwen Image Edit 2.1 的 CLIP 编码从 51.3 秒压到 6.7 秒(约 7.6 倍),完整渲染从 66 秒降到 21 秒,仅改 prompt 的二次运行从 62 秒降到 18.5 秒。

做法:节点在内存中给 Qwen VL vision encoder 打补丁,把 vision patch-embed 的 Conv3d 换成数学上等价的线性算子(输出逐位一致),可在同一工作流中 A/B 对比;再加独立的 Reference 节点和 Fast Text Encode,实现参考图像缓存——不换参考图只改 prompt 时不再重复编码。原节点对正负 prompt 各编码一次是浪费,改后只编码一次。

注意:目前只在作者机器(comfyui-rocm 构建)上验证,NVIDIA 未测;作者推测同样使用 Qwen VL vision tower 的模型(如 MiniMax H3)可能受益。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →