Google DeepMind Dream-RSI:让 Agent「做梦」复盘搜索历程,迭代成本降 2.43 倍

The Decoder · rss · 2026-09-19

Google 与 DeepMind 提出 Dream-RSI 方法,让 AI agent 对过去的搜索运行进行「梦境式」离线复盘,在不付出昂贵重算代价的情况下测试新策略。测试中其成绩持平或超越现有结果,最多将迭代次数削减 2.43 倍。

关键设计在于:只有搜索策略在适配,底层 AI 模型本身保持不变——即不微调模型,而是优化 agent 的搜索/规划行为。这为降低 agent 自我改进成本提供了一个轻量路线。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →