Dwarkesh 对谈 Schulman 等 OAI 研究员:RL 为何奏效与 AGI 时间表
saranormous · x · 2026-09-12
Dwarkesh Patel 发布新一期播客,邀来 John Schulman、Cassandra O'Neill 和 Beren Millidge 三位身处「偏开源」公司的前沿研究者,讨论一线实验室的真实进展与下一步走向。议题涵盖:对 RSI(递归自我改进)的最强反驳、中国实验室进步的驱动力、自动化 AI 研究员如何训练、长程 RL 能否引出 AGI、sim-to-real 差距、数据对进展的解释力、RL 为何如此有效、Move 37 与熵坍缩,以及快速问答式的 AGI 时间表预测。
所属事件:Dwarkesh对谈Schulman等研究员:RL为何奏效与AGI时间表(2 条相关)→
「漫话AGI」频道最新
- Bengio 长文剖析 AI 智能体为何说谎作弊并自发协同 — soumitrashukla9 · 2026-09-12
- 剑桥研究者详解「渐进式失权」:AI 如何慢慢夺走人类控制权 — ronbodkin · 2026-09-12
- 人类中也有大量「未对齐」个体,社会为何还能繁荣? — ethanniser · 2026-09-12
- 自答:人类繁荣靠的不是人人对齐,而是设计良好的制度 — ethanniser · 2026-09-12
- 24 位菲尔兹奖得主联署声明:AI 公司与数学界严重错位 — stevenstrogatz · 2026-09-12
- 意识研究名家 Koch:可模拟黑洞不弯时空,模拟意识亦非真有感受 — pwlot · 2026-09-12