DeepMind 发布 Dream RSI,让智能体在历史探索中自我改进
Google DeepMind 发布 Dream RSI 工作,被视为迈向递归自我改进(RSI)的一步。该方法不重训模型、不修改权重,而是把智能体真实探索留下的历史搜索树当作「模拟世界」,在其上虚拟推演新的探索策略(即「做梦」),从过去尝试中学习并循环改进。据称该方式最高可将调用量降低 162 倍。
2026-09-17 ~ 2026-09-17 · 2 条相关
- 第 1 集:谷歌开源 Dream-RSI:靠「做梦」复盘实现递归自我改进(2026-09-15,14 条)
- 第 2 集:DeepMind 发布 Dream RSI,让智能体在历史探索中自我改进(2026-09-17,2 条)
- DeepMind 发布 Dream RSI:智能体从既往尝试中自我改进 — MickeySteamboat · 2026-09-17
- 谷歌Dream-RSI:让AI在历史搜索树里做梦,调用量最高省162倍 — 量子位 · 2026-09-17