Google 论文提出 RRSI:给递归自我改进的 Agent 加正则化

Google Research 发表 arXiv 论文《RRSI: Regularized Recursive Self-Improvement of Agent Harnesses》,研究 Agent Harness 层面的递归自我改进问题。研究发现 Agent 在自我进化过程中同样会出现过拟合现象,因此提出通过正则化约束来防止自我改进偏离目标,让递归自我改进更加稳健可靠。

2026-10-06 ~ 2026-10-07 · 2 条相关