Google 开源 RRSI:冻结参数下 Agent 递归自我改进
Google Research 联合 UNC、Stanford 等机构发布并开源 RRSI(Regularized Recursive Self-Improvement),通过正则化约束让 Agent 在模型参数冻结的前提下递归地自动改进自身框架。该方法在 Terminal-Bench 上将成绩提升至 80.2%,在分布外基准上最高提升 4.7 分,为不更新参数的持续自我改进提供了新路径。
2026-09-28 ~ 2026-09-29 · 2 条相关
- 第 1 集:Google 提出 RRSI:正则化约束 Agent 框架递归自我改进(2026-09-22,8 条)
- 第 2 集:Google 开源 RRSI:冻结参数下 Agent 递归自我改进(2026-09-28,2 条)
- RRSI 正则化约束智能体递归自我改进,分布外基准最高提升 4.7 分 — burny_tech · 2026-09-28
- Google 开源 RRSI:Agent 自动迭代自身框架,Terminal-Bench 提至 80.2% — sudoraohacker · 2026-09-29