DeepMind 发布 Dream RSI,让智能体在历史探索中自我改进

Google DeepMind 发布 Dream RSI 工作,被视为迈向递归自我改进(RSI)的一步。该方法不重训模型、不修改权重,而是把智能体真实探索留下的历史搜索树当作「模拟世界」,在其上虚拟推演新的探索策略(即「做梦」),从过去尝试中学习并循环改进。据称该方式最高可将调用量降低 162 倍。

2026-09-17 ~ 2026-09-17 · 2 条相关

事件全程(共 2 集)→