谷歌 Dream-RSI 实现 AI 自我改进循环,搜索成本最高降 162 倍
MickeySteamboat · x · 2026-09-17
- Google/DeepMind 研究者推出 Dream-RSI:AI 智能体通过回放自身过往发现尝试、低成本测试数千种替代策略,再将更优策略投入下一轮,从而持续改进探索方式。
- 在算法设计、数学优化和 GPU kernel 工程三类任务上,Dream-RSI 匹配或超越了原有发现质量,同时大幅削减搜索成本,其中一个场景中 agent 调用次数减少达 162 倍。
- 关键点在于:它改进的是探索策略(policy),而非底层模型权重。评论者感叹『递归自我改进论文正在涌现,RSI 已是我们世界的现实』。
所属事件:谷歌开源 Dream-RSI:靠「做梦」复盘实现递归自我改进(14 条相关)→
「漫话AGI」频道最新
- Stevesi:剥离拟人化话术,模型失准本质上就是 Bug — ylecun · 2026-09-17
- Florian Gallwitz:ASI 存在性风险之争已沦为无论据的骂战 — FlorianGallwitz · 2026-09-17
- 让 AI 真心做对齐研究后再揭晓:它就是被研究的那一方 — Kitchen-Jicama8715 · 2026-09-17
- Schmidhuber 重提哥德尔机:自指式最优自我改进是 RSI 圣杯 — SchmidhuberAI · 2026-09-17
- AI 模人人可得后,创业公司的「集中式雄心」成新优势 — vaibhavbetter · 2026-09-17
- 卫报评 OpenAI 就业平台:巨头正试图垄断从教育到工作的通道 — nordicinst · 2026-09-17