Google Dream-RSI:让 Agent「做梦」复盘探索史,实现递归自我改进

agihouse_org · x · 2026-09-16

Google 与 Google DeepMind 发布论文 Dream-RSI(Recursive Self-Improvement through Evolving Worlds),提出一条不同于「模型改自己权重」的 RSI 路线:Agent 修改的是自己的探索策略(harness)。

核心机制:

实验结果:在 GPU Kernel 任务中,VGG16 与 LayerNorm 达到相近性能分别少用 2.43× 和 1.79× 的 generations;ConvDiv 与 ConvMax 在相近预算下性能分别提升 2.09× 和 1.44×。

一个反直觉发现:传统做法——把过往经验总结后塞回 prompt 指导下一轮——反而更差,因为这些「经验」易变成偏见,让 Agent 过早收敛到少数方向,损失探索多样性。论文的启示是:模型未必先学会改权重,可以先学会改自己的 harness。

所属事件:Google 发布 Dream-RSI:让 Agent 在演化世界中「做梦」实现递归自我改进(5 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →