本地 AI 全流程实测:IndexTTS 2.5 配音 + MiniMax H3 生图 + 口型同步
CeFurkan · reddit · 2026-10-02
Reddit 用户 CeFurkan 展示了其用本地 AI 制作的最高质量视频,完整链路为:用 DoRA 微调 IndexTTS 2.5 克隆声音,用 MiniMax H3 生成图像,再做语音驱动口型同步。作者公开征询对声音与虚拟形象质量的反馈,视频已上传 YouTube 可直接观看。这是本地开源工具组合跑通音画全流程的一个参考案例。
「多模态」频道最新
- Minimax H3 生成马尔福形象,网友:明知是 AI 也不在乎 — SydSteyerhart · 2026-10-02
- xAI Grok 视频 4 美分一条:1.5 Lite 上线 Venice 低至半价 — lmoroney · 2026-10-02
- Fable 5.5 一句话生成可探索体素 3D 世界 — 141_1337 · 2026-10-02
- ComfyUI 新手求教:如何用参考图生成同一人物的新场景 — timmeresque · 2026-10-02
- 腾讯混元 AutoGUIWorld:用图像生成器当 GUI 世界模型,不跑软件合成 7.9 万条轨迹 — Tencent-Hunyuan · 2026-10-02
- 腾讯自适应奖励路由:前向过程 RL 动态优化音视频联合扩散的多奖励冲突 — tencent · 2026-10-02