MIT VISTA 给模型加视觉记忆,Claude 零训练通关全部 ARC-AGI-3
mark_k · x · 2026-10-03
MIT 研究者推出的 VISTA 方法让 AI 模型获得可主动检视的"视觉记忆":每一帧观察都被保留,模型在推理游戏规则时可回看早期画面、对比场景、放大细节。
借助该方法,Claude 在零额外训练的情况下完成了全部 25 个公开 ARC-AGI-3 游戏,动作数比首次游玩的人类玩家少 57.4%。Claude Opus 5.0 拿到满分 100 的动作效率分,GPT-5.6 Sol 达 99。该方案还在另外三个视觉基准上带来提升,但私有游戏测试仍待完成。
作者的核心观点:现有模型内部可能已蕴含大量能力,缺的是更好的工具与记忆机制——让 agent 能"再看一眼"就能带来巨大差异。
「模型」频道最新
- FrontierMath 两年被刷穿:新 GPT 满分通过 Tier 4,开放难题已解 9/49 — Afinetheorem · 2026-10-03
- 用上 Opus 5.5 之后的生活是什么感觉?AI 圈热传梗图 — StewartalsopIII · 2026-10-03
- Opus 5.5 一个 prompt 生成整款游戏:48 分钟把 1996 老游戏移植到 macOS — socialwithaayan · 2026-10-03
- Pro 用户发现 ChatGPT 定时任务疑似被改动,额度与稳定性引不满 — snug-crackle-policy · 2026-10-03
- 开源 Cascade 用 519B tokens 击败 Datadog Toto 2.0,少训 84.6% — bittingthembits · 2026-10-03
- 单台 128GB Strix Halo 跑 300B 级 MoE:Kyojin 引擎实测 GLM 26-30 tok/s — Yaniss916 · 2026-10-03