MemoBench:首测世界模型物体恒存,无一及格
机器之心 · wechat · 2026-07-06
来自哈佛、MIT、Google、CMU、IBM 等机构的研究者提出 MemoBench——首个面向动态环境的"可见-消失-重现"(V-D-R)世界建模评测基准,已被 ECCV 2026 接收。它用 360 段高质量真值视频,系统测试 10 个主流视频世界生成模型在物体暂时离开视野并持续变化后,能否记住其身份、推演其状态并在重现时准确还原。
结果显示,没有一个模型的"物体重现得分"超过 0.6(满分 1),说明现有视频生成模型即使画面连贯,也几乎无法在物体重新出现时正确恢复其在遮挡期间本应发生的状态变化。研究认为这揭示了"生成画面逼真"与"真正理解世界"之间的显著差距,为下一代世界模型提供了可量化的诊断标尺(物体恒存能力)。
所属事件:MemoBench评测显示顶级视频模型无法记忆物体状态(2 条相关)→
「多模态」频道最新
- FastH3-Live 升至 22fps:加速节点实测与 ComfyUI 显存避坑 — spartong945 · 2026-09-11
- Midjourney 风格参考分享:--sref 2912175708 — tisch_eins · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Hailuo 转推:MiniMax H3 MAX 一发生成 15 秒美食动画短片 — Hailuo_AI · 2026-09-11
- MiniMax Music 制作工具包 2.5 发布,新增完整母带处理链 — Vivid_Promise1700 · 2026-09-11
- ComfyUI 新节点发现器上线:按 star 增速过滤最新热门节点 — Luke2642 · 2026-09-11