MIT VISTA 给模型加视觉记忆,Claude 零训练通关全部 ARC-AGI-3

mark_k · x · 2026-10-03

MIT 研究者推出的 VISTA 方法让 AI 模型获得可主动检视的"视觉记忆":每一帧观察都被保留,模型在推理游戏规则时可回看早期画面、对比场景、放大细节。

借助该方法,Claude 在零额外训练的情况下完成了全部 25 个公开 ARC-AGI-3 游戏,动作数比首次游玩的人类玩家少 57.4%。Claude Opus 5.0 拿到满分 100 的动作效率分,GPT-5.6 Sol 达 99。该方案还在另外三个视觉基准上带来提升,但私有游戏测试仍待完成。

作者的核心观点:现有模型内部可能已蕴含大量能力,缺的是更好的工具与记忆机制——让 agent 能"再看一眼"就能带来巨大差异。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →