Google 团队提出 Dream-RSI:用离线模拟器实现递归自我改进
mikeflache · x · 2026-09-18
arXiv 新论文 Dream-RSI(作者来自 Google 团队)提出一个加速自主科学与数学发现的框架:
- 把 agent 的历史探索数据转换成低成本的离线回放模拟器
- agent 在这个模拟的「做梦」过程中先测试、迭代搜索策略,再部署到线上
- 从而以极少的真实模型调用算力,实现高效的递归自我改进(RSI)
核心卖点是用离线模拟替代在线试错,大幅降低自我改进的算力开销。
所属事件:谷歌 Dream-RSI:让 AI 在「梦境」中递归自我改进(7 条相关)→
「研究」频道最新
- CAIS 发布 HLE-Rolling:持续更新的「人类最后考试」替代版 — devindkim · 2026-09-18
- RLE-Bench:机器人自生长身体完成任务,暴露编码Agent物理推理短板 — daibond_alpha · 2026-09-18
- ENCODE GRAMMAR 模型文档改用交互式 HTML README 替代静态 PDF — anshulkundaje · 2026-09-18
- Aspen 世界模型×物理研讨会明年2月办,10月9日截止摘要 — randall_balestr · 2026-09-18
- Cell 专刊:生物医学需要能预测干预结果的世界模型 — rishabh16_ · 2026-09-18
- RLHF 之后又有 RLCD:用强化学习让 LLM 的置信度可校准 — prdeepakbabu · 2026-09-18