谷歌 RRSI 方法抑制智能体记题,新基准提升 4.7 分省 30% token
The Decoder · rss · 2026-10-04
自我改进的 AI 智能体常会记住测试任务本身,导致分数提升在新任务上缩水甚至消失。
谷歌研究人员提出新方法 RRSI,对这种记忆化效应加以约束,在未见过的基准上最高提升 4.7 分,同时比未正则化的版本少用约 30% 的 token。
这项工作揭示了自我改进训练中的一个关键隐患:智能体的“进步”可能只是对测试集过拟合,而非真实能力增长。
「编程与Agent」频道最新
- Claude 写 prompt 驱动 Midjourney 出图,AI 调度 AI 生成图像 — technollama · 2026-10-04
- Agent 不需要 GUI:shell 和 GNU 工具链能力无可替代 — Liu_eroteme · 2026-10-04
- 用 Agentgateway 的 ExtMCP 在方法层给 MCP 工具调用加护栏 — bibryam · 2026-10-04
- Scoble 用 AI agent 代读 X 社区,结论:「Harness 才是产品」 — Scobleizer · 2026-10-04
- 用 bubblewrap 和 tmpfs 给 AI agent 做沙箱隔离,密钥文件读不到 — Liu_eroteme · 2026-10-04
- Instinct 与 Muse 成其伴侣首个每日在用的 AI 智能体 — nateliason · 2026-10-04