从 MiniMax 换到 LTX-2.5:一条口播视频成本仅 $0.32
victor_explore · x · 2026-10-05
开发者 victorexplore 分享了他为虚拟口播应用 TenKicks 选型的过程:先尝试 MiniMax H3,但生成效果差——字幕造假、人物点头却不说话、镜头自作主张移动,于是「解雇」了它。改用开源的 LTX-2.5 后,工作流简化为一张人脸照片 + 一段语音 + 一条指令:语音驱动口型,单张 runpod GPU 上 16 分钟生成 63 秒口播,每条 reel 的 GPU 成本仅 $0.32,且开源权重、无订阅费用。展示的 11 条视频中人物均为 AI 生成,口型与自造语音完全同步。
所属事件:开发者实测 LTX-2.5 与 MiniMax H3 唇形同步(2 条相关)→
「多模态」频道最新
- UniMate 发布 3D 绑定骨骼模型,网友提议接入 ComfyUI — RazsterOxzine · 2026-10-05
- AI 歌曲《Close all the windows》制作全流程公开:提示词与 Midjourney 素材全放出 — Afinetheorem · 2026-10-05
- OctLLM 用八叉树显式编码 3D 几何,兼顾语言能力与空间结构 — _akhaliq · 2026-10-05
- Gemma 31b「Grand Horror」+ H3 生成恐怖短片引围观 — jrexthrilla · 2026-10-05
- EditHero:首个长程部件级 3D 编辑基准,对比两种编辑路线 — _akhaliq · 2026-10-05
- Suno + KlingAI 打造斯洛伐克语说唱 MV「Stoka Roka」 — Jazzlike_Animator_70 · 2026-10-05