MemoBench:首测世界模型物体恒存,无一及格
机器之心 · wechat · 2026-07-06
来自哈佛、MIT、Google、CMU、IBM 等机构的研究者提出 MemoBench——首个面向动态环境的"可见-消失-重现"(V-D-R)世界建模评测基准,已被 ECCV 2026 接收。它用 360 段高质量真值视频,系统测试 10 个主流视频世界生成模型在物体暂时离开视野并持续变化后,能否记住其身份、推演其状态并在重现时准确还原。
结果显示,没有一个模型的"物体重现得分"超过 0.6(满分 1),说明现有视频生成模型即使画面连贯,也几乎无法在物体重新出现时正确恢复其在遮挡期间本应发生的状态变化。研究认为这揭示了"生成画面逼真"与"真正理解世界"之间的显著差距,为下一代世界模型提供了可量化的诊断标尺(物体恒存能力)。
所属事件:MemoBench评测显示顶级视频模型无法记忆物体状态(2 条相关)→
「多模态」频道最新
- 微调后的 Krea 2 raw 模型做出了一张雨夜驾驶图 — darlens13 · 2026-07-27
- 有人在问 Video2X 能否加载 OpenModelDB 自定义模型 — Used-Profit2355 · 2026-07-27
- 有人想让 AI 逆向拆解爆款视频特效成 ComfyUI 流程 — stale2000 · 2026-07-27
- Midjourney V8.2 加入个性化并展示新图像效果 — Mr_AllenT · 2026-07-27
- Midjourney 图像多样性引发 Krea 2 对比与复现提问 — diffusion_throwaway · 2026-07-27
- AI 短片把 1985 年反乌托邦拍成电影感作品 — ProfessorKey98 · 2026-07-27