研究者警告:自改进 Agent 大概率在过拟合训练任务

HuaxiuYaoML · x · 2026-09-23

Google 研究团队指出,当前能让 Agent 自动改写自己的 prompt、工具、记忆与工作流的「自改进」方法,往往只在练过的任务上涨分,换到新任务上收益常常消失甚至归零——本质是过拟合。团队给出的解法是把正则化引入递归自改进过程,约束每轮候选修改的提案与选择,详见其 RRSI 论文(arXiv:2609.24972)。

所属事件:Google 提出 RRSI:正则化约束 Agent 框架递归自我改进(8 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →