MiniMax H3 接上自定义音频做唇形同步,作者放出新工作流指南

AI_Trenches · reddit · 2026-08-19

作者尝试把 ComfyUI 里的 LTXV 音频编码节点接到 MiniMax H3 的采样器上输入自定义音频,结果"直接就能用":唇形同步效果比 LTX 系模型更好,且兼容 lightx2v LoRA,只需 6–8 步采样。作者已写好完整指南并附上可下载的工作流文件。

所属事件:MiniMax H3接入自定义音频,唇形同步效果超LTX(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →