MiniMax H3 实战:搭建音频驱动对口型视频工作流
CountFloyd_ · reddit · 2026-08-05
开发者发现原本用于音频转视频的 LTX 节点同样适用于 MiniMax H3 模型,因此快速构建了一个音频驱动的对口型视频生成工作流。该方案利用参考图像和输入音频,结合更快的原生 I2V 工作流(而非 R2V),并额外使用模型从音频流中提取人声以实现最佳唇形同步。工作流已分享至 Pastebin。
「多模态」频道最新
- MiniMax 视频模型实测:用 4 张图生成汤姆·赫兰德吃街头小吃 — CurieuxExplorer · 2026-08-05
- MiniMax H3 开启早访:主打多模态生成与精准场景编辑 — HeyAmit_ · 2026-08-05
- 单机8卡训视频世界模型,北大开源MiniWorld框架 — PekingUniversity · 2026-08-05
- SandAI 发布 114B 音视频生成模型 MAGI-2 预览版 — Nice_Amphibian_8367 · 2026-08-05
- Seedance 2.5 视频模型上线,支持 30 秒原生生成与多模态参考 — HeyNayeem · 2026-08-05
- Seedance 2.5 上线 Lumina AI:支持单次生成 30 秒视频 — HeyNayeem · 2026-08-05