外部 LLM 先做设计决策再出图:Qwen Image 2.1 提示词模板实测
wjc_5 · reddit · 2026-09-28
作者分享了一套让 Qwen Image 2.1 接近闭源模型设计水平的工作流:核心是用外部 LLM 先把图像需求转成结构化提示词,明确构图、信息层级、排版和布局决策,而不只是罗列画面元素。官方 T2I 改写提示词解决描述完整性、I2I 提示词保证编辑一致性,但不替模型做视觉设计决策,这正是该模板补的缺口,特别适合海报和文字密集的图。
实用参数:40 步采样质量提升明显且耗时可接受;无大字图用 4.0–4.2 百万像素,大字海报建议 2.0–2.5 百万像素以免文字不稳,不建议低于 2.0;未发现加速 LoRA 必要,可能损害画质,可用 ComfyUI Kitchen 加速。
局限:手脚肢体不稳定,人像美感主观上不如 Z Image 或 Krea 2。完整教程已上传 YouTube,工作流资源在评论区。
「多模态」频道最新
- 网友让 Opus 5.5 做太空探索电影:每一帧每个音符都由代码写就 — prasenx · 2026-09-28
- Opus 5.5 竟可一键生成 MV,自建管线开发者直呼被超越 — nptacek · 2026-09-28
- 可灵 4.0 官宣 10 月发布,Flash 版已对 Ultra 年费用户开放 — koltregaskes · 2026-09-28
- 博主抢先实测 Kling 4.0 Flash:提示词理解力惊人 — umesh_ai · 2026-09-28
- Opus 5.5 生成讲解视频,KP 重制 WebMCP 入门指南 — thisiskp_ · 2026-09-28
- AI 动效设计短板:音乐同步与音效生成仍不达标 — ciguleva · 2026-09-28