MiniMax H3 接上自定义音频做唇形同步,作者放出新工作流指南
AI_Trenches · reddit · 2026-08-19
作者尝试把 ComfyUI 里的 LTXV 音频编码节点接到 MiniMax H3 的采样器上输入自定义音频,结果"直接就能用":唇形同步效果比 LTX 系模型更好,且兼容 lightx2v LoRA,只需 6–8 步采样。作者已写好完整指南并附上可下载的工作流文件。
所属事件:MiniMax H3接入自定义音频,唇形同步效果超LTX(2 条相关)→
「多模态」频道最新
- 开源 1.7 亿参数多语言 TTS 模型 Audio8 — CatAstro_Piyush · 2026-08-20
- Minimax H3 I2V 无法保持白背景?用户求助解决方案 — noaxxx2 · 2026-08-20
- 从六指兄弟到众叛亲离:AI 创作圈回忆录 — AIandDesign · 2026-08-20
- 《龙与地下城》地下城地图模型升级:基于 Krea 2 的 TTRPG 生成器发布 — Familiar-Art-6233 · 2026-08-20
- 老硬件还能战:8GB显存跑 Flux LoRA 工作流该不该换新模型? — wreck_of_u · 2026-08-20
- AI 短剧 App 角色一致性如何做到?用户好奇 NetShort 们的生成管线 — yooheenn · 2026-08-20