AI 短片角色一致性:锁定参考表击败纯提示词
NecessaryDelay9249 · reddit · 2026-08-21
作者分享了一个在 30 镜头短片(跨越 60 年、6 国)中保持角色一致的工作流。发现纯文本描述会导致面部漂移,解决方案是前置生成“锁定参考表”:包括四视图、六面板微距图(脸、手、布料、首饰)和半身像,并将其作为所有镜头的唯一事实来源,而非重复描述。在生成新镜头时,仅针对参考表描述年龄和服装的增量变化。使用的工具包括 Nano Banana Pro、GPT Image、Kling 3 Pro、Seedance 2.0 和 ffmpeg。
「多模态」频道最新
- DeepSeek 发布 V4 Flash Vision 图像理解 API — aigclink · 2026-08-21
- 商汤开源8B多模态模型U1.5Lite:支持4K输出生图 — 智东西 · 2026-08-21
- Indic-Translate 发布:支持 22 种印度语言的 32K 上下文翻译 — prajdabre · 2026-08-21
- 实测 MiniMax H3 视频延展工具 — Jayuniue · 2026-08-21
- 中国开源模型视觉短板有望补齐:GLM 新版与 DeepSeek 视觉版 — intellectronica · 2026-08-21
- 假如 Claude Fable 5 开汉堡店:AI 生成的画面 — georgemillo · 2026-08-21