大众盲测打脸研究员:MiniMax H3 胜过字节 Seedance 2.5
葬AI · wechat · 2026-08-07
为打破少数研究员对视频模型评价的垄断,葬AI 团队推出了基于梗图与复杂提示词的盲测基准 memebench。该测试收集了 50 个 B站抖音热门梗图,邀请 400 位大众(含大学生与网吧用户)进行两两盲选投票,采用 Elo 机制计算模型相对实力。
测试结果出人意料:MiniMax H3 获得第一名,得分甚至略微领先此前长期无敌的字节 Seedance 2.0,而主打电影质感的 Seedance 2.5 仅位列第三。
文章分析指出,Seedance 2.5 虽然画面最逼真,但在复杂动作连贯性上严重倒退,被戏称为“高级PPT”;而 MiniMax H3 凭借极强的指令遵循能力与动作连贯性后来居上,在激烈动作场景下优势尤为显著。
所属事件:MiniMax H3 与 Seedance 2.5 实测对比与盲测争议(6 条相关)→
「多模态」频道最新
- Seedance 2.5深度解析:从短视频到电影感,AI视频的质变与行业冲击 — 数字生命卡兹克 · 2026-08-07
- Runway 发布 Seedance 2.5:支持更多参考图与更长视频片段 — runwayml · 2026-08-07
- Runway 发布 Seedance 2.5:支持更多参考图与更长片段 — runwayml · 2026-08-07
- Magnific 集成 Seedance 2.5,新增 3D 运动控制与 4K 放大 — LudovicCreator · 2026-08-07
- Kyutai 音频转 MIDI 模型 MuScriptor 升级,支持自动测速 — petewoodbridge · 2026-08-07
- 探讨 KREA 2 LoRA 分块测试与工作流搭建 — dariusredraven · 2026-08-07