Z-Image Base 提示词实测:自然语言场景块比 tag 列表更可控

Maleficent-Bowl-4841 · reddit · 2026-09-04

一位 Reddit 用户在 ComfyUI 中用 Z-Image Base INT8(Qwen3 4B 文本编码器、50 步、CFG 4、768×1368、多个 seed)做了纯文生图的控制实验,不用 ControlNet/IP-Adapter/LoRA,测试提示词对构图与环境的影响。

实验与发现:

可复用结论:按「主体 → 构图 → 相机 → 环境 → 光照/细节 → 风格」组织提示词,像描述物理场景一样写,可在角色稳定性与场景灵活性间取得平衡。作者也注明样本量小、为定性观察,多主体/高 CFG 下结果可能不同。

所属事件:实测显示自然语言提示词更能精准掌控 Z-Image Base(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →