用 MiniMax H3 做口型同步:完整 ComfyUI 工作流开源

uhf789 · reddit · 2026-09-05

作者演示用 MiniMax H3(ComfyUI 内)结合 Topaz Video AI 的 Proteus 模型和 CapCut,对 Nilüfer《Geceler》专辑封面做口型同步视频,并公开了完整工作流文件。用法简单:输入参考图和目标音频,渲染时长对齐音频长度;为获得最佳口型一致性,需把音频的准确文字转写填入提示词字段。工作流由作者借助 Claude 开发。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →