谷歌 Dream-RSI 让智能体「做梦」自进化:317 次调用碾压 5 万代搜索

新智元 · wechat · 2026-09-17

谷歌联合 Google DeepMind、马里兰大学等发布 Dream-RSI 论文,展示不改动底层权重的递归自我改进路线:把智能体的探索历史存成「发现树」,策略迭代时直接在树上重放历史(不调模型、不跑代码),如同棋手复盘棋谱。

核心机制:

实测结果:

反直觉发现:把历史总结成高层「经验提示」注入 prompt,反而显著劣于无指导基线——抽象原则会变成认知偏见、压缩探索空间;而 Dream-RSI 直接在具体历史树上做代码级优化,保持探索多样性。一作 Tong Zheng 为马里兰大学博士生、谷歌暑期研究员。

所属事件:谷歌开源 Dream-RSI:靠「做梦」复盘实现递归自我改进(14 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →