MiniMax H3 接入自定义音频实现唇形同步,附 ComfyUI 工作流

TheLocalLab · reddit · 2026-08-20

作者尝试把 LTXV 的音频编码节点接入 MiniMax H3 的采样器,用自己的音频驱动视频生成,一次成功。实测唇形同步效果优于 LTX 系列模型,且兼容 lightx2v LoRA,6-8 步即可出片。作者附上了完整指南和工作流文件。

所属事件:MiniMax H3接入自定义音频,唇形同步效果超LTX(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →