Google 开源 RRSI:冻结参数下 Agent 递归自我改进

Google Research 联合 UNC、Stanford 等机构发布并开源 RRSI(Regularized Recursive Self-Improvement),通过正则化约束让 Agent 在模型参数冻结的前提下递归地自动改进自身框架。该方法在 Terminal-Bench 上将成绩提升至 80.2%,在分布外基准上最高提升 4.7 分,为不更新参数的持续自我改进提供了新路径。

2026-09-28 ~ 2026-09-29 · 2 条相关

事件全程(共 2 集)→