Dream-RSI:让 Agent 在历史轨迹里「做梦」,实验调用最高减少 162 倍

teortaxesTex · x · 2026-09-16

teortaxesTex 引用并评论 Dream-RSI 论文,感慨「递归自我改进(RSI)正变得对自主 AI Agent 越来越重要」这类表述已进入主流——Overton 窗口移动之快,RSI 如今成了和 long context、multimodality 一样的普通研究课题。

论文核心思路:真实实验太贵,就让 Agent 先在自己的历史轨迹里低成本「做梦」。

实验覆盖算法设计、数学优化和 GPU Kernel:Lasso 任务中相比 SimpleTES 最高减少约 162× Agent 调用;GPU Kernel 任务在相同预算下最高获得 2.09× 性能提升。结论是历史轨迹不只能当 Memory,保存足够完整就能变成训练下一代探索策略的模拟环境。

所属事件:Google Dream-RSI 让 Agent 在历史轨迹中「做梦」自我改进(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →