无人值守 Agent 为何反复重做已完成任务:一场思想实验

ClickOk5811 · reddit · 2026-10-09

Reddit 用户提出一个思想实验来解释长时程 Agent 的常见失败模式:想象一个永远无法把完成的事"划掉"的同事——40 项任务做到第 25 项时,桌上堆着大量已完成的工作,他会反复端详、甚至重做。

作者认为这正对应无人监督 Agent 在长多步任务中的行为:比如重构时重命名接口并更新所有调用点,几小时后它可能重新修改已经改对的文件——因为没有任何东西把步骤标记为"已关闭",所有工具调用和已完成步骤都仍在上下文里,权重与当前步骤相当。

他指出,人在回路中时问题少很多,因为聊天中你的下一句话会隐式告诉模型前面的事已敲定;拿掉人之后没有任何机制接手。作者认为更大的上下文窗口帮不上忙(只是给已完成的工作更多空间),更可行的方向是显式机制:强制 Agent 推进前更新任务清单,或把已完成步骤折叠成一行摘要。作者未做实测,并在评论区征求跑通宵任务者的经验。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →