一人包揽 AI 音乐 MV:作者实测全流程,称「单人制片厂」不到一年
kraussian · reddit · 2026-09-23
一位创作者历时约一个月,完全用 AI 生成了完整长度的官方音乐视频《Do Not Go Gentle》,并给出详细工作流:
- 工具链:Suno 作曲 → GPT Image 生成静态图 → MiniMax H3(Checkpoint 与 Turbo LoRA 混用)配 ComfyUI 默认工作流做图生视频;曾考虑 Seedance 但嫌价格高放弃;拼接剪辑部分由 Claude 协助写 Python 脚本完成
- 成本结构:每段 5-10 秒的镜头,平均要迭代约 20 版静态图 + 约 10 次动画生成才能满意
- 已知的 MiniMax 痕迹:远景人物(<15% 画面高度)面部模糊、幻觉式动作和光照问题
- 结论:成片约 90% 「达标」,但再用当前一代 MiniMax H3 精修已极其困难;作者判断「一人制片厂」距现实不到一年。
「多模态」频道最新
- 通过 Miora 工作流实测混元 Image 3.5:提示词到生成到审阅 — HeyAmit_ · 2026-09-23
- 混元 Image 3.5 写实度实测:光照、材质与镜头语言是关键 — HeyAmit_ · 2026-09-23
- 实测腾讯混元 Image 3.5 预览版:文字、参考图与编辑控制是亮点 — HeyAmit_ · 2026-09-23
- 网易有道开源两款语音模型:2B 流式 ASR 与 14B 中英同传 — AdinaYakup · 2026-09-23
- 博主称 Opus 5.5 一次性生成完整 newsletter 上线视频 — alex_verem · 2026-09-23
- PixVerse R2 实测:视频模型不再是片段,而是能 WASD 走进去的世界 — HeyAmit_ · 2026-09-23