实测 MiniMax H3 + Suno:AI 全自动生成对口型说唱视频
Artefact_Design · reddit · 2026-08-09
一位创作者分享了使用 AI 制作说唱音乐视频的完整工作流。他首先使用 Suno 生成纯人声(无伴奏)音轨,接着为说唱歌手制作了多角度的角色参考图,并选取真实的录音棚照片作为环境参考。最后,将这些素材输入 MiniMax H3 的全参考模式,通过结构化提示词(主体定义、镜头时间轴等)实现了精准的声乐对口型和连贯的镜头切换。作者指出,让模型在没有音乐的情况下仅跟随人声进行口型同步是最具挑战性的部分。
所属事件:实测MiniMax H3等AI工具制作MV工作流(2 条相关)→
「多模态」频道最新
- NexusBTA 更新:支持 MiniMax H3 本地视频生成与加速 — Jp_Andre · 2026-08-09
- MiniMax H3实测:单提示词生成末日场景大片 — SpicyAccountants · 2026-08-09
- Grok Imagine 新功能实测:支持图像元素独立编辑 — iamaliveix · 2026-08-09
- 开源 LoRA Dataset Studio:一张参考图全自动生成训练数据集 — Ill-Ant-9489 · 2026-08-09
- 不止于唇形同步,海螺 H3 视频模型展现强大舞蹈同步能力 — bennash · 2026-08-09
- 马斯克称 Grok Imagine 图像编辑能力大幅提升 — hexiang · 2026-08-09