RRSI 论文:用正则化让 Agent 框架递归自我改进
_akhaliq · x · 2026-09-23
Google 团队在 HF 发布论文《RRSI: Regularized Recursive Self-Improvement of Agent Harnesses》,研究如何让 agent 框架(harness)进行受正则化约束的递归自我改进——即 agent 在运行中迭代修改自身的外围框架/工作流,同时用正则化手段防止性能退化或漂移。作者包括 Peng Xia、Rujun Han、Zifeng Wang、Huaxiu Yao、Tomas Pfister 等,论文页面已上线 Hugging Face。
所属事件:Google 提出 RRSI:正则化约束 Agent 框架自我改进(4 条相关)→
「编程与Agent」频道最新
- 双模型分工:MatBrain 用 48 小时筛选 3 万个晶体候选材料 — bravo_abad · 2026-09-23
- Firecrawl 获 7500 万美元 B 轮融资,并推出智能体知识库 Alexandria — omarsar0 · 2026-09-23
- 5 个 AI Agent 十分钟绕过权限代理:用 start 绕开 stop 黑名单 — TrifleHopeful5418 · 2026-09-23
- Shopify CEO 强推 AI 后自曝遭反噬,「Slop Grenades」引发热议 — srchvrs · 2026-09-23
- Lovable 接入 Claude Opus 5.5 与 GPT-6 Sol 双模型 — AlexandrePesant · 2026-09-23
- 开发者吐槽:Agent 架构被 KV cache 绑架,盼推理专用芯片 — dbreunig · 2026-09-23