无需 LoRA:把文本编码器当 LLM 用,Krea 2 出图多样性轻松翻倍
prookyon · reddit · 2026-10-03
针对 Krea 2 出图过于可预测、不同种子结果几乎相同的抱怨,作者分享了一个简单解法:复用 ComfyUI 里的文本编码器模型(如 Qwen3VL 4B)作为 LLM 做 prompt 扩展(PE),不需要 LoRA,也不需要模型专用的自定义节点。
关键点:
- 系统提示词随便选——作者甚至用的是 Qwen 2.1 的 PE 系统提示词,只要面向图像生成就有效。官方模板自带的 PE 也可以直接换任意系统提示词。
- 这样得到两个控制旋钮:PE seed 带来剧烈变化,sampler seed 做细粒度微调。
- 性能开销小:5070Ti 上 3MP 图、int8、8 步约 18 秒,PE 只额外增加约 4 秒;文本编码器本来就要加载,不额外占显存。
- 不必使用 abliterated/uncensored 版本文本编码器,普通 Qwen3VL 4B 作为文本生成器时限制出奇地少,且替代模型会损害最终画质。
- 工作流里的一些自定义节点(rgthree、easy-use 等)纯属便利,与 PE 本身无关。
作者附上未筛选的前 5 张随机示例图和完整工作流链接,证明只需极短提示词就能获得足够多样的结果。
「多模态」频道最新
- 网友用 AI 生成《回到未来 4》伪预告片,画面质感惊艳 — chodtoo · 2026-10-03
- 全开源模型拼出 AI 卡牌对战游戏 Chimera Arena,战斗视频逐回合实时生成 — Ill-Ant-9489 · 2026-10-03
- ComfyUI 新节点 .char:一次锁定人脸身体服装,告别角色漂移 — ashishsanu · 2026-10-03
- 网友花数周逆向研究 WAI Illustrious 模型的工作原理 — Limp_Okra_5496 · 2026-10-03
- 「时序幽灵成像」提示词:错位色彩通道造出穿越时间平面的幻影 — LudovicCreator · 2026-10-03
- 用 70 年代赛璐璐动画技巧省成本,Opus 生成太空摇滚歌剧 — Aargau · 2026-10-03