PRO-LONG 用完整行动日志,让长程智能体在 ARC-AGI-3 提升 18 分
rohanpaul_ai · x · 2026-07-24
这篇论文的核心观点很直接:长任务智能体想做得更稳,记忆最好别过早压缩或丢弃。
- 作者提出 PRO-LONG:不是不断总结旧信息,而是把每一次观察、动作、结果和短计划都写进一个结构化日志里。
- 之后智能体再用普通工具(例如搜索命令、Python)去从日志中找回真正相关的证据。
- 在 ARC-AGI-3 的 25 个隐藏规则游戏 上,这种方法让同一基座智能体平均提升了 18 个百分点。
- 它还能以 少 4.2 到 5.8 倍 的计费 token,达到或接近更强的专用系统表现。
- 论文结论是:长程智能体记忆,也许最有效的不是“更会总结”,而是保留完整记录 + 可编程检索。
所属事件:PRO-LONG框架用程序化记忆提升长程智能体表现(2 条相关)→
「编程与Agent」频道最新
- Kimi K3 接入 Blender MCP,可直接搭建并修正 3D 场景 — CSProfKGD · 2026-07-24
- 增强版 Google Maps MCP Server 提供 14 个地图与环境工具 — modelcontextprotocol · 2026-07-24
- 企业 AI Agent 仍像是循环、记忆和工具的拼接 — Johannascot · 2026-07-24
- 微软 Copilot 这套工作 AI 工具终于开始能用了 — koltregaskes · 2026-07-24
- Codex 和 Claude Code 已能跑通父子 Agent 工作流 — huangyun_122 · 2026-07-24
- Claude Code 搭配 CodeRabbit,把生成和审查串成一条链 — CodeByPoonam · 2026-07-24