ComfyUI 教程:结合 Krea2 与 Qwen3-VL 实现参考图风格局部重绘
TBG______ · reddit · 2026-08-12
开发者分享了在 ETUR 测试中发现的一种强大工作流:利用 Krea2 和 Qwen3-VL 模型在 ComfyUI 中实现带有参考图风格的局部重绘。
- 核心功能:该节点支持在保留原图全局语义的前提下进行局部重绘,并能优化 Differential Diffusion 的效果。建议在使用时降低 Qwen3-VL 编码图像的影响力,并将去噪强度保持在 0.8 以下。
- 输入与控制:用户需提供基础图像(及蒙版)和参考图像(及指定提取区域的 ref-mask)。通过不同的 VL Source Mode 进行差异化编码,并可通过强度值灵活控制各输入元素在生成过程中的权重。
- 适用场景:非常适合基于提示词和参考图风格融合的图像编辑,但并非用于精确的图像复制粘贴。
该节点将包含在即将发布的 TBG ETUR 1.12.12 自定义节点更新中。
「多模态」频道最新
- LTX-2.5 视频模型即将开源,多镜头与提示词遵循大升级 — cocktailpeanut · 2026-08-12
- LTX 2.5视频模型确认兼容2.3版LoRA — ArttTaku · 2026-08-12
- 马斯克展示用 Grok 生成蒸汽朋克风格视频 — elonmusk · 2026-08-12
- LTX-2.5 视频模型发布:支持原生多镜头连贯生成 — ltx_model · 2026-08-12
- 实测 MiniMax H3:动漫动作场景生成工作流与提示词解析 — Fabulous-Snow4366 · 2026-08-12
- Maestro:一键启动的本地 AI 视频与音乐工作室 — cocktailpeanut · 2026-08-12