专题 · FULL STORY

LTX-2.5开源发布:速度与画质的实测之争

Lightricks开源视频生成模型LTX-2.5,凭借极快生成速度和低门槛本地部署引发社区实测热潮,但画质细节与动作表现仍存争议。

2026-08-11 ~ 2026-08-14 · 3 集 · 58 条

第 1 集 · LTX 2.5与MiniMax H3实测对比:速度碾压但画质存分歧(2026-08-11,23 条)

近期,AI社区针对开源视频生成模型LTX 2.5(含2.3)与MiniMax H3进行了多角度实测对比。LTX 2.5在生成速度上展现出碾压级优势,但在画质细节、物理规律及复杂场景处理上仍存短板;H3则在真实感与图生视频能力上更胜一筹。目前测试结果因创作者侧重点与硬件环境不同而呈现分歧,尚无绝对赢家,但两者均展现出在消费级显卡上媲美商业模型的潜力。

已确认

  • 生成速度优势:LTX 2.5在速度上表现极其优异。@koakoAI实测在生成10秒1080P视频时,LTX 2.5耗时2分34秒,比H3快6倍;@florodude在6000S显卡上仅需15秒即可生成内容,而H3需120秒;@skyrimer3d在RTX 4080上生成5秒1080p视频仅需不到1分钟;@cointalkz在RTX 5090上生成10秒720p视频仅需2分钟。
  • 硬件门槛:LTX 2.5在RTX 4080 16GB、RTX 3060 16GB RAM、RTX 5090等设备上均实测可用;MiniMax H3在RTX 3060上顺利运行,并可搭配Turbo lora以6步生成视频。
  • LTX 2.5画质与短板:@No-Property3068指出LTX 2.5在镜头运动和微小细节上存在短板,不及H3;@smereces反馈其存在人体结构变形和一致性差的问题;@xdcfret1补充其物理规律容易翻车;@PuppetHere对比后认为2.5与前代2.3无明显差异。
  • MiniMax H3优势:@Dry-Statistician-684指出H3的图生视频能力惊艳,能轻松处理多镜头剪辑并搭配自定义音频;@FeePrestitious7272和@cointalkz均认为H3的生成质量明显优于LTX 2.5;@beatlepol实测H3在IP知识与名人识别能力上表现更好。
  • LTX 2.5实用性:@CupQuakeBE放弃H3转投LTX 2.5,认为其在复杂场景处理上有质的飞跃;@Similar-Reserve-3581认为LTX 2.5虽不能直接生成长对话视频,但作为视频创作工作流增强工具极具价值;@seppe0815驳斥了社区对LTX 2.5的负面水帖,强调其实际效果非常好。

尚未确认

  • 绝对王者:因测试侧重(多镜头剪辑、复杂场景、图生视频)与硬件环境不同,LTX 2.5与H3尚无绝对性能赢家。

为什么重要

  • 开源视频生成模型在低显存消费级(如RTX 3060/4080)上的可用性大幅提升,且在复杂场景连贯性、角色一致性及生成速度等传统痛点上展现突破,为本地创作者提供了高效或高质量的免费替代方案。

还有 3 条相关讨论 →

第 2 集 · Lightricks开源LTX-2.5视频模型,原生多镜头生成(2026-08-11,24 条)

Lightricks于8月11日至12日正式发布并开源视频生成模型LTX-2.5。该模型对原有架构的生成管线进行了全面重构,采用更大的数据集和强化学习后训练,支持原生多镜头连贯生成、音视频同步生成(48 kHz高音质)以及高保真渲染,推理速度极快(如单图6.8秒生成10秒4K视频)。模型提供22B蒸馏及完整版权重,原生兼容ComfyUI和Diffusers,并附带9个预置ComfyUI工作流,登顶Hugging Face热门榜单,上线fal和Runware等平台。当前结论是,LTX 2.5为开源社区提供了强大的视频创作工具,但在面部细节处理上仍存瑕疵,竞争力受质疑。

已确认

  • 模型提供22B蒸馏及完整版权重,采用全新扩散解码器与压缩模型,在保持极快推理速度的同时有效减少了压缩伪影。
  • 原生支持多镜头生成,将多个镜头作为连续序列处理,在单次生成中输出多段连贯镜头,保持角色、环境和声音的一致性。
  • 全面重构生成管线以减少提示词重试与纹理破损,采用定制版Gemma 4 12B作为骨干网络读取提示词。
  • 引入Diffusion Fidelity Rendering(扩散保真渲染)技术,针对复杂场景分配更多算力以提升画面质量。
  • 支持文生视频、图生视频、音视频同步生成等多模态任务,原生兼容ComfyUI和Diffusers等主流工作流,并附带9个预置ComfyUI工作流。
  • 展现出优秀的向后兼容性,开发者无需升级ComfyUI或更改现有工作流,LTX 2.3版本的大部分LoRA可以直接替换权重继续使用。
  • 模型已登顶Hugging Face热门榜单,并上线fal以及Runware等平台。

尚未确认

  • 根据@EverythingMacPro对示例视频的观察,LTX系列此前面部扭曲的弱点似乎仍未得到完全修复。在MiniMax H3等竞品大幅提高行业门槛的背景下,他对LTX 2.5的市场竞争力表示担忧。

为什么重要

  • LTX 2.5的开源与多平台适配大幅降低了开发者使用高级视频生成技术的门槛,其原生多镜头生成与高保真渲染能力为影视创作和复杂场景处理提供了新的开源解决方案。

还有 4 条相关讨论 →

第 3 集 · LTX 2.5实测:速度快门槛低,动作与台词仍受限(2026-08-13,11 条)

LTX 2.5 视频生成模型近期引发社区实测热潮。多位创作者证实其生成速度极快,并可在 6GB 显存的低配设备上本地运行,大幅降低本地视频生成的硬件门槛;但复杂动作处理与指定台词生成仍是明显短板。速度与门槛的双重优势,使消费级与中端显卡快速产出电影感视频成为现实。

已确认

  • 速度与质量:@iiTzMYUNG 发布用 LTX 2.5 制作的短片混剪与评测视频,高度认可其生成速度与出图质量,并分享创作工作流、提示词技巧与参数优化方法。@princeMacX 在 RTX 5070 Ti 上实测 LTX-2.5 Distilled,认为浪漫对话、风景与产品镜头等简单电影级场景质量极高,建议关闭提示词增强以获得更好效果。
  • 低显存本地运行:@cocktailpeanut 宣布 WanGP 已支持 LTX-2.5,专为 6GB+ 低显存机器优化,可经 Pinokio 一键安装;其在 NVIDIA A4500 上实测 10 秒 480p 视频仅需 3 分钟,音频效果令人满意。@cgpixel23 发布支持 6GB 显存的 ComfyUI 低显存工作流,覆盖文生视频与图生视频,实测 1344x768、7 秒视频耗时 10 分钟,并认为其运动、口型同步与声音表现更好。
  • 数字人与长视频:@CharacterTitle876 在 RTX 5060(16GB 显存)上以 448x1024 分辨率、蒸馏模型加 LoRA 生成 30 秒数字人视频,耗时约 7 分钟。@tostane 借“苍蝇测试”观察眼部等细节变化,在 960x544 分辨率下通过调整参数成功生成长达 2 分钟的视频,并分享显存与功耗瓶颈的应对经验。
  • 图生视频与 CGI:@b-totherent 测试图生视频,将真人实拍与 3D CGI 结合,用提示词构建记者在极简房间采访拟真机器人“2.5”的电影感场景,并规定 21:9 画幅与浅景深。

尚未确认

  • 复杂动作缺陷:@princeMacX 以蝙蝠侠与小丑打斗为例实测,发现复杂动作下人体结构崩坏、手部运动不真实,提示词遵循能力较差,部分提示词