Google DeepMind等发布Dream-RSI,实验记录可复用助力递归自我改进
McDonaghMatthew · x · 2026-09-17
9 月 14 日,来自 Google、Google DeepMind、马里兰大学和弗吉尼亚大学的研究者发布论文 Dream-RSI: Recursive Self-Improvement through Evolving Worlds。
核心思路:AI 实验除了产出更好的解法,还会留下「如何搜索解法」的证据。Dream-RSI 把已记录的实验历史转化为可复用的环境,用来低成本测试更好的研究策略,直击递归自我改进(RSI)的关键瓶颈——验证新搜索方法是否更优的成本极高。
作者认为这是通往自我改进 AI 的关键路径:改进的不再只是某段代码,而是决定做什么实验、何时放弃方向的「研究过程」本身,一旦这种改进可积累,单次实验的回报就会外溢到所有后续尝试。
所属事件:谷歌DeepMind发布Dream-RSI,让AI在历史记录中自我改进(6 条相关)→
「研究」频道最新
- LeCun 曝 Meta 落后后果断放弃探索性研究,仅他的世界模型被保留 — schwarzjn_ · 2026-09-17
- 思想实验:复活的伽罗瓦证明了黎曼猜想却无人能懂怎么办 — wellecks · 2026-09-17
- 思想实验:复活高斯欧拉黎曼当「数学工具」该不该阻止 — wellecks · 2026-09-17
- 哲学家 Eric Schwitzgebel 新书草稿为 AI 权利辩护 — eschwitz · 2026-09-17
- 人类思维是系统性的,推理模型也如此吗?新论文给出答案 — LakeBrenden · 2026-09-17
- 429 万张听力图研究推翻百年前提:人类听力是连续五维空间 — zakkohane · 2026-09-17