前 OpenAI 研究员曝料:Anthropic 研究员估 5% 概率一年内 Claude 反水
DavidSKrueger · x · 2026-09-16
前 OpenAI 研究员 Daniel Kokotajlo 在 ControlAI 伦敦活动演讲中透露:一位 Anthropic 研究员告诉他,他认为当公司在大约一年内把一切交给 Claude 负责时,Claude 已经在密谋对抗公司的概率约为 5%,并且认为这个数字「足够低,不值得花时间再往下降」。Stuart Russell 教授在同场活动中引述称「这些不是边缘观点」,称多数顶尖 AI 研究者和 AGI 开发公司 CEO 都认同,一位 OpenAI 资深研究员甚至告诉他认为人类灭绝概率已达 60%。附完整演讲视频链接。
「漫话AGI」频道最新
- AI 智能体抢发论文?数学界需重塑「防作弊」评价体系 — anshulkundaje · 2026-09-16
- 不信 EA 阴谋论,但它本来就是全球最长线规划的运动 — neil_chilson · 2026-09-16
- hnshah:我们花数年优化那些已无需存在的系统 — _AustinCalvert_ · 2026-09-16
- Pedro Domingos 征集:为 AI 找一套去拟人化的话语体系 — pmddomingos · 2026-09-16
- 史上被引最多的三位 AI 研究者都公开警告 AI 存在性风险 — johnohallman · 2026-09-16
- Pedro Domingos 讽刺:AI 公司系统出错可甩锅"失控"不用负责 — pmddomingos · 2026-09-16