Meta 论文:仅增工具记忆不足,Agent 需学会何时调用

daniel_mac8 · x · 2026-08-24

Meta 最新论文指出,单纯给 Agent 增加记忆和工具是不够的,关键在于训练 Agent 何时值得使用这些外部状态。研究提出的 EvoHarness-RL 方法将 Qwen2.5-8B 在 ALFWorld 上的成功率提升至 96.9%,同时将 Harness 的调用次数降至每轮约 1 次。这意味着长任务中 Agent 需要管理状态并遗忘已完成步骤。

所属事件:Meta 新研究:用强化学习教 Agent 决策何时调用记忆(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →