MiniMax H3 生成语音音量失控,音频复用可部分绕过
Dogluvr2905 · reddit · 2026-08-21
用户实测 MiniMax H3 时发现:无论提示词写 quiet/distant mic,还是把参考音频增益压到极低,生成的语音音量始终偏大——模型似乎只看波形模式,不感知音量与距离。一个可行绕过是用 audioreuse 直接复用降低音量后的 wav,但副作用是该音频会替换整段视频所有声音,无法同时生成环境音。
「多模态」频道最新
- 网友用 Grok 与 Kling AI 制作诗意视频 — creatoroff · 2026-08-21
- 网友用视频生成做出字面意义的「猫鱼」:猫头鱼身合体 — littleteckmonkey · 2026-08-21
- 小红书FireRedTTS3统一语音生成与编辑,多评测第一 — 机器之心 · 2026-08-21
- 实测 99% 方案后的最佳 AI 广告制作工作流 — EXM7777 · 2026-08-21
- Grok 一键生成并剪辑人类迁徙视频 — JoeJustice · 2026-08-21
- GitHub 热门:img2threejs 实现图像转 3D 代码生成 — anselm · 2026-08-21