杜克研究:用代码检索记忆让 ARC-AGI-3 提升 18 个百分点
imjustnewatai · x · 2026-07-23
杜克大学研究者认为,很多场景里模型不缺“更大的脑子”,更缺的是更好的记忆。
他们把每一次交互都记录下来,再让模型用代码去检索这些历史记录。结果在 ARC-AGI-3 的 25 场公开游戏中,这种做法相较于同一基础 agent,成绩提升了 18 个百分点。
这篇研究的核心结论是:在这类任务里,外部记忆/检索机制可能比单纯扩大模型规模更关键。
「编程与Agent」频道最新
- 个人 AI 电脑控制 Agent 已做到 141 个 Python 文件 — Vivid_Ad_5069 · 2026-07-23
- Pond 招聘 SF 负责人,做 AI agent 竞赛市场 — ThePeterMick · 2026-07-23
- Claude Opus 5 传闻、OpenAI Codex 语音 agent 与 Cerebras 750 tok/s — imjustnewatai · 2026-07-23
- Grok Build 文档新增权限、Plan Mode、沙箱和子智能体 — elonmusk · 2026-07-23
- Cloud agent 应该跑在持久机器上,而不是每个 PR 新建沙箱 — aidenybai · 2026-07-23
- 一个开源 Agent Skill 项目主打 100 多个模板,星标已超 12.6 万 — Saboo_Shubham_ · 2026-07-23