大众盲测打脸研究员:MiniMax H3 胜过字节 Seedance 2.5

葬AI · wechat · 2026-08-07

为打破少数研究员对视频模型评价的垄断,葬AI 团队推出了基于梗图与复杂提示词的盲测基准 memebench。该测试收集了 50 个 B站抖音热门梗图,邀请 400 位大众(含大学生与网吧用户)进行两两盲选投票,采用 Elo 机制计算模型相对实力。

测试结果出人意料:MiniMax H3 获得第一名,得分甚至略微领先此前长期无敌的字节 Seedance 2.0,而主打电影质感的 Seedance 2.5 仅位列第三。

文章分析指出,Seedance 2.5 虽然画面最逼真,但在复杂动作连贯性上严重倒退,被戏称为“高级PPT”;而 MiniMax H3 凭借极强的指令遵循能力与动作连贯性后来居上,在激烈动作场景下优势尤为显著。

所属事件:MiniMax H3 与 Seedance 2.5 实测对比与盲测争议(6 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →