如何用 LTX 2.5 在 ComfyUI 里生成 40 秒以上连续说话视频
Majestic-Regret-3030 · reddit · 2026-09-10
一位本地跑 ComfyUI(RTX 3060 12GB + 32GB RAM)的用户求教:如何用 LTX 2.5 生成 40-60 秒的固定机位说话人物视频。
核心问题包括:
- LTX 2.5 能否直接连续生成 40 秒以上,还是应分段生成(每段 8-10 秒)再用末帧续接
- 分段续接时如何保持人脸、服装、背景、机位与运动一致——关心重叠帧、首末帧条件化、视频扩展、参考帧等隐藏转场的方法
- 语音与唇形同步方案:先生成完整斯洛伐克语语音,再让角色跟随音频;是用 LTX 2.5 做身体头部运动再叠 MuseTalk/LatentSync 等唇同步模型,还是用音频直接驱动 LTX 2.5
- 竖屏 9:16 输出下可能需要降分辨率、offloading、分块与更长渲染时间
他明确只想要围绕 LTX 2.5 的实战工作流(节点、每段时长、重叠帧数、语音与唇同步工具),不要泛泛的 talking head 模型清单。
「编程与Agent」频道最新
- Hy4 preview 实测:一条 prompt 产出可玩的 3D 生存游戏 — mhdfaran · 2026-09-10
- 网友分析 Astra xhigh 的 token 高效可能源于给子代理的指令 — Al_Grigor · 2026-09-10
- 同题对比 DeepSeek V4.1 Flash 与 GPT-6 Astra:写码风格差异一目了然 — kevinkern · 2026-09-10
- OmniParse 开源:20 种文件格式一键转为 LLM 可用数据 — tom_doerr · 2026-09-10
- 曝 Meta 为 Muse 开发共享智能体,或于 Meta Connect 发布对决 OpenAI — testingcatalog · 2026-09-10
- Meta Muse 应用暗藏共享智能体入口,可创建可配置子智能体 — testingcatalog · 2026-09-10