一句重复台词,就能跨镜头锁住人脸和声音
Minute_Eye_6270 · reddit · 2026-07-23
作者把 JoyAI-Echo 的跨镜头角色记忆 和 LTX-2.3 的语音 结合起来,实现了“一句重复台词”就能让角色的脸和声音在每个镜头里保持一致。
帖子里给出的内容
- 具体工作流
- 权重/量化格式:bf16、fp8、Q8、Q5、INT8
- 一个可免费试玩的 Demo Space
整体上这是一个多模态视频生成工作流展示,重点是跨镜头身份一致性,而不是单纯的模型发布。
「多模态」频道最新
- Grok Imagine 视频生成实测:精准控制角色情绪表演 — chaitu · 2026-07-23
- HeyGen 的 HyperFrames 为 AI 视频加入先分镜后生成流程 — HeyGen · 2026-07-23
- Midjourney 与 GPT-4o 结合生成超预期 AI 图像 — aziz4ai · 2026-07-23
- LTX 2.3 实用工作流:分镜图直出视频与多场景控制 — Sad_Coach_1433 · 2026-07-23
- Seedance 2.0 提示词把多工具生成串起来 — azed_ai · 2026-07-23
- Qwen3.6 35B 多模态 GGUF 版本在 HF 走热 — LuffyTheFox · 2026-07-23