递归自我改进易过拟合,Google 提出 RRSI 让 agent 泛化

burkov · x · 2026-10-01

AI agent 的表现高度依赖其 harness——包裹核心模型之外的提示词、控制流、工具接口与记忆管理。当前研究趋势是用递归自我改进(recursive self-improvement)自动化优化这套 harness。

但 Google AI 的新文章指出:针对固定训练任务集进化 agent 往往导致严重过拟合——agent 会记住 benchmark 特有细节、追逐评测噪声、累积臃肿复杂度,性能提升在部署到未见过的真实任务时崩溃。

为此文章提出 Regularized Recursive Self-Improvement(RRSI) 框架:在自动化 harness 自我改进的同时,通过正则化手段保证学到的机制能泛化到留出环境,核心目标是引入统计上的泛化保证。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →