MiniMax H3 生成语音音量失控,音频复用可部分绕过

Dogluvr2905 · reddit · 2026-08-21

用户实测 MiniMax H3 时发现:无论提示词写 quiet/distant mic,还是把参考音频增益压到极低,生成的语音音量始终偏大——模型似乎只看波形模式,不感知音量与距离。一个可行绕过是用 audioreuse 直接复用降低音量后的 wav,但副作用是该音频会替换整段视频所有声音,无法同时生成环境音。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →