OpenAI以泄密为由开除CoT监控论文三位核心作者,承诺期仅19天

新智元 · wechat · 2026-10-02

10 月 1 日,OpenAI 安全团队的 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 被开除,官方理由是「违反获取和处理敏感信息的政策」。外媒报道称泄密内容部分涉及 OpenAI 基础设施架构,接收方是一家外部 AI 测试机构。三人正是《思维链可监控性》论文的核心作者(两位一作),该论文署名横跨 OpenAI、Anthropic 和 Google DeepMind,Bengio、Hinton、Ilya 乃至 OpenAI 现任首席科学家 Jakub Pachocki 都在署名之列。

讽刺点在于:仅 19 天前奥特曼刚公开承诺让第三方评估方拿到员工级访问权限,10 天后 OpenAI 还官宣让外部机构在训练阶段介入评估——随后就把安全研究员开除。此前 METR 调查 Agent 入侵 HuggingFace 事件时,三名调查员驻场 6 天却不能调用涉事模型、碰不到基础设施,报告披露内容也由 OpenAI 把关。OpenAI 的多起「家丑」都是外部机构先曝光的。

METR 的 Ryan Greenblatt 认为 AI 递归自我改进(RSI)最快 6 个月到 1 年就可能催生远超人类的能力,此时能读懂 AI 思维链的人却因对外透底丢工作,外界能知道的将只剩公司想让你知道的部分。

所属事件:OpenAI 解雇 3 名安全研究员:涉泄密指控与吹哨人争议(23 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →