LTX-2.3 实测:单图+音频生成高同步视频

egeberkina · x · 2026-07-29

开发者展示了使用 LTX-2.3 模型生成视频的惊艳效果。该模型能够基于单张起始图片、一段音频轨道和文本提示词,生成连贯的视频。

其突出亮点在于极佳的音画同步能力:人物的面部表情、肢体动作甚至吉他演奏细节,都能精准匹配并响应输入的音频节奏。

所属事件:LTX-2.3实测:单图结合音频即可生成高同步视频(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →