微软论文:记忆写入前先验证,agent 通过率 39%→73%、成本减半
rohanpaul_ai · x · 2026-09-15
微软新论文建议:长时运行的 agent 应在把经验写入持久记忆前,先验证该「教训」是否正确且可复用——验证应发生在记忆写入时。理由是:一次完成的 agent 运行不是 ground truth,可能含错误假设、不完整流程或日后过时的事实。
做法:每个任务结束后,由一个独立的记忆 agent 以只读权限访问环境,检查哪些内容值得保留,再写入长期记忆。在 CLBench 上:
- 通过率从 39% 提升到 73%
- 每任务查询次数从 8.8 降到 4.7
- 任务 agent 成本从 $3.38 降到 $1.68
所属事件:微软新论文:Agent 记忆写入前先验证,通过率翻倍成本减半(2 条相关)→
「编程与Agent」频道最新
- 倒着造谜题:滑铁卢大学发布 2 万题 ORBIT 数据集训练搜索 agent — CShorten30 · 2026-09-15
- 独立开发者自建安全管理清单,覆盖其 40+ 应用项目 — saibharadwaj · 2026-09-15
- JetBrains 支持的 ThinkRail 开源,主打 AI 时代的规格驱动开发 — makingthematrix · 2026-09-15
- 在 AGENTS.md 写「别过度设计」,agent 回敬一个防过度设计框架 — granawkins · 2026-09-15
- 4000 次实测:96 个工具只掉 9 分,agent 第三轮才是真瓶颈 — EastVersion1226 · 2026-09-15
- 网友用 OpenAI Astra 配合 Codex 逐帧复刻《超时空要塞 7》游戏 — algo_diver · 2026-09-15