实测 MiniMax H3 + Suno:AI 全自动生成对口型说唱视频

Artefact_Design · reddit · 2026-08-09

一位创作者分享了使用 AI 制作说唱音乐视频的完整工作流。他首先使用 Suno 生成纯人声(无伴奏)音轨,接着为说唱歌手制作了多角度的角色参考图,并选取真实的录音棚照片作为环境参考。最后,将这些素材输入 MiniMax H3 的全参考模式,通过结构化提示词(主体定义、镜头时间轴等)实现了精准的声乐对口型和连贯的镜头切换。作者指出,让模型在没有音乐的情况下仅跟随人声进行口型同步是最具挑战性的部分。

所属事件:实测MiniMax H3等AI工具制作MV工作流(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →