Agent 死循环根源不是模型笨,是失败记录污染了上下文

RunAI_Coder · reddit · 2026-09-01

一篇被广泛讨论的 Reddit 分析帖指出,agent 反复尝试同一失败方案并道歉重试,机械原因是模型无状态、每轮重读完整 transcript——四轮失败后,transcript 里占主导的就是失败尝试本身,next-token 预测器把历史当作「本会话一贯做法」而非「方向错误的证据」。

关键论据:一项 SWE-bench 轨迹研究发现,失败 run 中 agent 有 72-81% 的概率已经定位到正确文件——问题从来不是找不到位置,而是无法放弃错误假设。

有效的修复都在 harness 层而非 prompt 层:

作者最后求助:有没有不会误伤合法重试(如 flaky 测试、限流)的重复检测方案?

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →