LTX-2.5开源视频模型:原生多镜头生成,破解角色一致性难题

JafarNajafov · x · 2026-08-12

LTX-2.5 引入了原生多镜头生成(Native multishot)功能,将多个镜头作为连续序列处理,从而在镜头切换时保持角色、环境和声音的一致性,解决了传统 AI 视频逐镜生成易导致画面突变的问题。

该模型还升级了提示词理解能力,采用定制的 Gemma 4 12B 骨干网络读取指令,并配备专门的 E2B 提示词增强器。此外,新增的时长预测头能在扩散开始前分析提示词,为包含多个动作的场景分配合适的视频长度。

得益于开源特性,开发者可将其灵活适配到短片、产品视频、广告概念等创作管线中。

所属事件:Lightricks 发布开源视频模型 LTX-2.5(16 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →