用 Minimax H3 做首支 MV:全参考提示词工作流全公开
Select_Bowler3099 · reddit · 2026-09-08
作者分享了用 Minimax H3 制作音乐视频的完整工作流:R2V + 4 步 Loora、0.6 MP 分辨率生成,再用 SeedVR2 放大。核心是一套「全参考模式视频提示词工程师」系统提示词。
提示词设计要点:
- 输出固定六个英文段落:subjectdefinitions、summary、retentionanalysis、detaileddescription、overallsoundscape、nondiegeticmusic。
- 用 <Subject N> / <Picture N> / <Video N> / <Audio N> 标签统一引用人物、关键帧、参考视频与音轨,并要求跨段落保持一致。
- summary 需以任务类型前缀开头,如 [reference generation]、[video continuation]、[audio reference]。
- 严格要求绝对忠实:不得增删视觉元素、动作或结构细节,保留每个感官细节与镜头/音频设计;台词与歌词用 <d> 标签包裹并保留原语言。
这套结构化模板可迁移到任何支持全参考的视频生成模型。
「多模态」频道最新
- 曝张一鸣亲督字节秘密研发实时世界模型,最快 10 月亮相 — dotey · 2026-09-09
- Reddit 用户 vibe coding 出免费 CMYK 网点节点,含 37 种预设 — darkside1977 · 2026-09-09
- AI 电影制作正在转向:不再描述画面,而是先定义整个世界 — AIwithGhotai · 2026-09-09
- 「重新生成」成 AI 视频的 Ctrl+Z:局部修复正在取代整段重roll — Fast_Dependent742 · 2026-09-09
- Inworld TTS 模型正式 GA,CEO 播客谈端到端语音栈 — agihouse_org · 2026-09-09
- GPT-6 Astra 写几何代码接 Blender 渲染,再由 Dreamina 成片 — thetripathi58 · 2026-09-09