Rich Sutton:合成数据是大错,目标是持续学习的万亿参数大脑

Training Data (Sequoia) · rss · 2026-08-18

强化学习先驱 Rich Sutton 与学生 Khurram Javed 创立 Oak Lab,致力于构建能从自身经验中持续学习而非依赖人类数据的智能体。Sutton 认为“持续学习”才是常态,批评当前主流的合成数据路径是“大错”。他们的“大世界假设”指出世界远比模拟器复杂,因此模型必须持续更新而非冻结。Sutton 称 LLM 是意外的突破,但仅占智能的四分之一,且灾难性遗忘可通过他们的持续反向传播算法治愈。他们预想 5-10 年内实现 20 瓦功耗、保持一致性且持续学习的万亿参数“大脑”。目前前沿大厂因陷入局部最优解而难以转向这一新范式。

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →