MiniMax H3 视频生成实测:角色难以精准卡点音乐节拍

PhilMcGraw · reddit · 2026-08-09

用户实测 MiniMax H3 模型发现,虽然能顺利导入音频并完成角色对口型,但很难让角色精准地跟随音乐节拍跳舞。目前的提示词往往只能生成无规律的晃动或机械的摆动,缺乏对音乐节奏的理解。作者询问社区是否有人找到可行的提示词方案,并提及 LTX-2.3 曾在这一场景表现优异。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →