Dwarkesh 对谈 Schulman 等 OAI 研究员:RL 为何奏效与 AGI 时间表

saranormous · x · 2026-09-12

Dwarkesh Patel 发布新一期播客,邀来 John Schulman、Cassandra O'Neill 和 Beren Millidge 三位身处「偏开源」公司的前沿研究者,讨论一线实验室的真实进展与下一步走向。议题涵盖:对 RSI(递归自我改进)的最强反驳、中国实验室进步的驱动力、自动化 AI 研究员如何训练、长程 RL 能否引出 AGI、sim-to-real 差距、数据对进展的解释力、RL 为何如此有效、Move 37 与熵坍缩,以及快速问答式的 AGI 时间表预测。

所属事件:Dwarkesh对谈Schulman等研究员:RL为何奏效与AGI时间表(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →