专题 · FULL STORY

MiniMax H3实测:惊艳画质背后的音频失控

MiniMax H3视频模型虽以惊艳画质著称,但近期密集实测暴露出其严重的音频与动作控制缺陷。用户发现角色常不受控地发出乱码噪音,音效功能失效,凸显出模型在多模态对齐上的短板。

2026-08-04 ~ 2026-08-10 · 3 集 · 9 条

第 1 集 · MiniMax H3视频生成翻车:角色胡言乱语复读提示词(2026-08-04,3 条)

多名用户实测反馈,MiniMax H3 模型在通过参考图生成视频(R2V)时出现严重的对白控制异常。生成画面中的人物不仅会不受控制地发出胡言乱语般的杂音,还会将提示词中引号外的动作描述原样复读出来。即使提示词极其简单,模型在说出目标台词前后也常常夹带多余的废话,暴露出该模型在语音指令遵循和对白精准控制方面的短板

第 2 集 · MiniMax视频模型现幻觉:用户难控角色闭嘴(2026-08-09,2 条)

近期,多位用户在使用 MiniMax 视频生成模型时遇到了相同的控制难题。当用户期望角色仅做表情变化而不发声说话时,模型频繁产生幻觉。无论尝试何种提示词进行规避,生成的人物总是会自动张嘴,并伴随无意义的唇部动作和乱码声音。目前用户尚未找到有效的提示词解决方案,纷纷发帖向社区求助,寻求能让角色彻底闭嘴的应对策略。

第 3 集 · MiniMax H3视频模型实测暴露多项音频与动作Bug(2026-08-09,4 条)

尽管MiniMax H3在视频画面上表现惊艳,但实测暴露出多项严重缺陷。用户发现提示词中的音效与配乐功能失效,生成的语音多为乱码噪音,多主体场景下还出现声音串扰。此外,模型难以让角色精准卡点音乐节拍跳舞,仅能生成机械摆动,音频与动作对齐能力亟待优化。