外部 LLM 先做设计决策再出图:Qwen Image 2.1 提示词模板实测

wjc_5 · reddit · 2026-09-28

作者分享了一套让 Qwen Image 2.1 接近闭源模型设计水平的工作流:核心是用外部 LLM 先把图像需求转成结构化提示词,明确构图、信息层级、排版和布局决策,而不只是罗列画面元素。官方 T2I 改写提示词解决描述完整性、I2I 提示词保证编辑一致性,但不替模型做视觉设计决策,这正是该模板补的缺口,特别适合海报和文字密集的图。

实用参数:40 步采样质量提升明显且耗时可接受;无大字图用 4.0–4.2 百万像素,大字海报建议 2.0–2.5 百万像素以免文字不稳,不建议低于 2.0;未发现加速 LoRA 必要,可能损害画质,可用 ComfyUI Kitchen 加速。

局限:手脚肢体不稳定,人像美感主观上不如 Z Image 或 Krea 2。完整教程已上传 YouTube,工作流资源在评论区。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →