MiniMax H3 实战:搭建音频驱动对口型视频工作流

CountFloyd_ · reddit · 2026-08-05

开发者发现原本用于音频转视频的 LTX 节点同样适用于 MiniMax H3 模型,因此快速构建了一个音频驱动的对口型视频生成工作流。该方案利用参考图像和输入音频,结合更快的原生 I2V 工作流(而非 R2V),并额外使用模型从音频流中提取人声以实现最佳唇形同步。工作流已分享至 Pastebin。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →