H3 视频模型音频生成技巧与提示词经验汇总
SechsGoatNine · reddit · 2026-08-17
帖子旨在汇总 H3 视频模型音频部分的生成技巧与理解。目前观察到的要点包括:高质量生成效果更好;移除 <d> 标签可避免视频开头出现随机说话人;人声易盖过背景音;背景音常为白噪音。帖主进一步询问对话提示词分段写法、背景音效(如引擎、鸟叫)的最佳位置,以及动作音效的平衡提示方法。
「多模态」频道最新
- Seedance 2.0 实测:4K AI 视频已能拍清松枝落雪与渡鸦眼神 — heypearlai · 2026-08-17
- 微软 MAI-Image 实测:两分钟出 6 套浴室装修情绪板 — AmyKateNicho · 2026-08-17
- RTX 3060 跑 MiniMax H3:4 步 LoRA 加速 2 倍并上采样到 2K — cgpixel23 · 2026-08-17
- 实测 MiniMax H3 加速 LoRA:约九成 Seedance 2 水准 — Key-Rice-6431 · 2026-08-17
- NoSpoon x H3 音乐视频 Agent 测试:12 分钟生成 — Kyrannio · 2026-08-17
- 照片变抽象编辑海报的 Codex Skill 爆火,GitHub 已 2.8K Star — oran_ge · 2026-08-17