MiniMax H3 接入自定义音频实现唇形同步,附 ComfyUI 工作流
TheLocalLab · reddit · 2026-08-20
作者尝试把 LTXV 的音频编码节点接入 MiniMax H3 的采样器,用自己的音频驱动视频生成,一次成功。实测唇形同步效果优于 LTX 系列模型,且兼容 lightx2v LoRA,6-8 步即可出片。作者附上了完整指南和工作流文件。
所属事件:MiniMax H3接入自定义音频,唇形同步效果超LTX(2 条相关)→
「多模态」频道最新
- 使用 Minimax Inpainting 本地 RTX 3090 实现换头功能 — Repulsive-Rush3505 · 2026-08-20
- NORD SOMMAR: 用 Kling + Flux 制作的瑞典岛屿微短剧 — ReallyNiceShipper · 2026-08-20
- OpenAI 最新视频被指测试语音转视频模型,评论区已关闭 — dsmny · 2026-08-20
- 开源工具 Pixel Snapper:一键把 AI 像素画吸附到完美网格 — tom_doerr · 2026-08-20
- Minimax H3 本地生成视频:角色对话与口型同步实测 — TigerClaw305 · 2026-08-20
- Minimax H3 实测:Ref2v 工作流转化战锤场景 — tammy_orbit · 2026-08-20