长任务智能体的主动记忆代理
burny_tech · x · 2026-07-13
这篇论文提出了一个用于长时程智能体的主动记忆代理:主智能体在执行过程中容易忘记早先的需求、失败尝试和有用发现,因此作者引入一个独立的 memory agent 来跟踪重要事实,并只在这些信息可能影响下一步动作时再提醒主智能体。
论文声称,这种设计在两个基准上带来了提升:
- Terminal-Bench:pass@1 提升 8.3 分
- τ²-Bench:pass@1 提升 6.8 分
- 另外,一个训练好的开权重记忆模型也提升了 3.5 分
核心思路是把“记忆”和“执行”解耦,让长链路 agent 更稳定地保留关键上下文。
「编程与Agent」频道最新
- alphaXiv 开源 OpenResearch:用任意模型并行跑研究智能体 — alphaXiv · 2026-09-11
- MathModelAgent 走红:自动完成数学建模并生成可提交论文 — jihe520 · 2026-09-11
- 开源 AI 销售 OS DeskcommCRM 爆火:自带 Agent 与 WhatsApp 集成 — melgarafael · 2026-09-11
- hyperresearch 开源:让 Agent 把网络调研沉淀为可搜索知识库 — jordan-gibbs · 2026-09-11
- Forter 两周全员 Agent 冲刺 13 条经验:跳过自建 RAG 靠企业搜索 — bibryam · 2026-09-11
- 拆解两款真实「公司大脑」:Slite 与 Gorgias 同台对比构建之道 — femke_plantinga · 2026-09-11