实战分享:用多模态工具组合打造高一致性 AI 角色
Gocciole · reddit · 2026-08-09
作者分享了一套保持 AI 角色在多张图片和视频中视觉一致性的工作流,成功应用于连载性质的虚拟 Cosplay 项目。
核心工具链:
- Google Flow:用于复杂的服装与造型迁移。
- Krea 2 Turbo:结合身份 LoRA 和锁定参考图生成其余静态图像。
- MiniMax H3 Ref2VA:用于视频生成,采用双参考图结构(一张控制场景与光影,另一张专门锁定面部身份),有效防止画面变动时的人脸漂移。
提示词技巧:采用“KEEP-first”提示词策略。不再为每个新镜头写全新描述,而是先生成一张锚点图,随后的提示词优先声明保持不变的元素(如面部、妆容、服装、房间),然后再描述变化的内容。
「多模态」频道最新
- 腾讯混元发布 3D 生成新项目 WorldClaw — Uncle___Marty · 2026-08-09
- Seedance 2.5 实测:支持局部编辑与最多 50 个参考素材 — alifcoder · 2026-08-09
- 字节 Seedance 2.5 上线 Lumina 平台,实测视频效果超预期 — alifcoder · 2026-08-09
- Midjourney混合ChatGPT:打造微缩恐怖电影感大片 — umesh_ai · 2026-08-09
- AI电影制作并非“一键生成”:创作者展示复杂后期剪辑时间线 — gen_ericai · 2026-08-09
- ComfyUI 插件更新:全面支持 Minimax H3 模型 — Obvious_Set5239 · 2026-08-09