PRO-LONG 以 log.txt 记忆框架拿下 ARC-AGI-3 97.4%
GregKamradt · x · 2026-07-28
PRO-LONG 在公开 ARC-AGI-3 上以 1,750 美元拿到 97.4%
这篇论文提出了 PRO-LONG:一种面向长程推理的最小化上下文管理框架,核心做法是保留完整、结构化的 log.txt,再在历史记录上做搜索,而不是把信息硬塞进有限上下文。
- 在 公开 ARC-AGI-3 集上,作者报告用 Fable 5 取得 97.4% best@2,总成本 1,750 美元。
- 相比此前 harness,整体使用 4.2–5.8 倍更少 token,同时还能达到或超过专用方案的表现。
- 作者强调:长任务的关键矛盾是“保留更多信息”与“更难检索相关细节”之间的权衡,而结构化日志+搜索能缓解这个问题。
- 论文、代码、日志和 scorecard 都已公开。
所属事件:PRO-LONG 框架在 ARC-AGI-3 取得 97.4% 得分(2 条相关)→
「编程与Agent」频道最新
- Emblem 称可把 80 页带引用 PPT 压到 35 分钟 — rohanpaul_ai · 2026-07-28
- Claude Opus 5 在编码中反复用 Python 脚本改文件 — samuelcolvin · 2026-07-28
- Vercel 展示开源技术栈,Eve 和 agent-browser 在列 — evilrabbit_ · 2026-07-28
- LightOn 搜索在 agent 基准上 86.27% 准确率只用 9.7 次调用 — IgorCarron · 2026-07-28
- AI 时代的等待方程:修 Bug 还是等下一代模型 — ilanbigio · 2026-07-28
- Kimi K3 结合 2.8T MoE、100 万上下文和多教师后训练 — novasarc01 · 2026-07-28