LTX-2.5开源视频模型发布:重构管线减少重试与伪影
aigleeson · x · 2026-08-12
Lightricks 发布开源视频世界模型 LTX-2.5,全面重构了生成管线以减少提示词重试、纹理破损和镜头不一致的问题。
核心管线设计:
- 指令解析:采用定制版 Gemma 4 12B 作为骨干网络读取提示词,并使用独立的 Gemma 4 E2B 提示词增强器处理指令,以最大程度保留用户的原始意图。
- 时长预测:引入时长预测模块,在扩散生成前根据提示词预测视频合理长度。
- 原生多镜头:支持在一条连续序列中生成多个摄像机镜头,并能跨剪辑保持角色、环境和声音的一致性。
- 视频解码:使用扩散视频解码器将生成结果转化为可视帧,改善高动态场景下的纹理重建并减少伪影。
训练与可用性:
模型从更大的数据集进行训练,并基于人类偏好进行了强化学习(RL)后训练,旨在提升首次生成的可用率。完整管线已开源,支持本地运行、代码检查、微调及本地部署,并提供 ComfyUI 和 Diffusers 兼容。
所属事件:Lightricks 发布开源视频模型 LTX-2.5(16 条相关)→
「模型」频道最新
- LiquidAI发布LFM2.5端侧模型:26亿参数跑通智能体 — JosephJacks_ · 2026-08-12
- Kimi长上下文配额被指存Bug,无操作进度异常跳跃 — evilsocket · 2026-08-12
- 用户反馈 Anthropic Opus 模型文本生成质量骤降 — alvelda · 2026-08-12
- 主流大模型 API 惊现同源提示词注入漏洞 — yoavgo · 2026-08-12
- 阿里 Qwen 官宣:Qwen3.8-27B 即将到来,编码更强 — airesearch12 · 2026-08-12
- MirrorCode 榜单加入 Gemini 3.1 Pro 评测 — scaling01 · 2026-08-12