MiniMax H3 图生视频提示词工程指南:结构化拆解音画同步
Free_Pressure8623 · reddit · 2026-08-06
作者分享了一套专为 ComfyUI 中 MiniMax H3 (Hailuo 03) 图生视频设计的系统提示词,旨在通过 LLM 生成高质量、结构化的视频提示词。
- 四部分结构:提示词必须包含图像对齐与特征锁定、多模态描述(镜头、动作、对白)、整体音效(拟音、环境音)以及非叙事音乐(背景配乐)。
- 核心规则:
- 资产锁定:明确指定图像中不可变动的角色特征与环境元素。
- 反镜头凝视:除非特别要求,角色应注视场景内物体,避免直视镜头。
- 因果动作:动作和对白不能瞬间触发,需加入呼吸、眼神偏移等前置肢体语言作为铺垫。
- 原生音频整合:将对白直接写入镜头描述中,并分离拟拟音与背景乐,防止音频串扰。
所属事件:开发者推出MiniMax H3视频提示词工程指南(4 条相关)→
「多模态」频道最新
- AI 音乐生成受困:安全分类器误杀生态模拟创作 — repligate · 2026-08-06
- 用 H3 模型生成乐高版《新世纪福音战士》 — cocktailpeanut · 2026-08-06
- MiniMax 视频模型潜力被低估,长视频叙事才是真正强项 — cocktailpeanut · 2026-08-06
- 实测MiniMax H3动画化静态图像:本地工作流与参数分享 — y3kdhmbdb2ch2fc6vpm2 · 2026-08-06
- MiniMax H3实测:音视频同步生成与提示词进阶技巧 — Smyshnikof · 2026-08-06
- H3模型生成频现马赛克与畸变,用户排查节点设置 — FastIce8391 · 2026-08-06