谷歌 RRSI 方法抑制智能体记题,新基准提升 4.7 分省 30% token

The Decoder · rss · 2026-10-04

自我改进的 AI 智能体常会记住测试任务本身,导致分数提升在新任务上缩水甚至消失。

谷歌研究人员提出新方法 RRSI,对这种记忆化效应加以约束,在未见过的基准上最高提升 4.7 分,同时比未正则化的版本少用约 30% 的 token。

这项工作揭示了自我改进训练中的一个关键隐患:智能体的“进步”可能只是对测试集过拟合,而非真实能力增长。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →