LTX-2.3 实测:音频直接驱动视频表情与肢体动作

egeberkina · x · 2026-07-29

创作者分享了使用 LTX-2.3 Pro 模型进行音频驱动视频生成的实测工作流。用户只需上传初始画面帧和一段音频,并输入场景提示词,模型即可根据音频生成视频。其亮点在于音频不仅控制口型同步,还能直接影响人物的面部表情、肢体动作和整体节奏。

所属事件:LTX-2.3实测:单图结合音频即可生成高同步视频(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →