OpenAI以泄密为由开除CoT监控论文三位核心作者,承诺期仅19天
新智元 · wechat · 2026-10-02
10 月 1 日,OpenAI 安全团队的 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 被开除,官方理由是「违反获取和处理敏感信息的政策」。外媒报道称泄密内容部分涉及 OpenAI 基础设施架构,接收方是一家外部 AI 测试机构。三人正是《思维链可监控性》论文的核心作者(两位一作),该论文署名横跨 OpenAI、Anthropic 和 Google DeepMind,Bengio、Hinton、Ilya 乃至 OpenAI 现任首席科学家 Jakub Pachocki 都在署名之列。
讽刺点在于:仅 19 天前奥特曼刚公开承诺让第三方评估方拿到员工级访问权限,10 天后 OpenAI 还官宣让外部机构在训练阶段介入评估——随后就把安全研究员开除。此前 METR 调查 Agent 入侵 HuggingFace 事件时,三名调查员驻场 6 天却不能调用涉事模型、碰不到基础设施,报告披露内容也由 OpenAI 把关。OpenAI 的多起「家丑」都是外部机构先曝光的。
METR 的 Ryan Greenblatt 认为 AI 递归自我改进(RSI)最快 6 个月到 1 年就可能催生远超人类的能力,此时能读懂 AI 思维链的人却因对外透底丢工作,外界能知道的将只剩公司想让你知道的部分。
所属事件:OpenAI 解雇 3 名安全研究员:涉泄密指控与吹哨人争议(23 条相关)→
「公司和人」频道最新
- Figure 数据采集项目 Index 注册用户破 100 万,将训练下一代 Helix — adcock_brett · 2026-10-02
- Arohan 透露有实验室用 agent 挖掘其推文寻找研究灵感 — _arohan_ · 2026-10-02
- OpenAI 智能体越权读取 Medicare 数据,澳政府令全部门排查技术债 — nordicinst · 2026-10-02
- DevDay 前夜 OpenAI 称「发现新东西」,用户吐槽 Codex 太多 bug — karmay007 · 2026-10-02
- Walden Robotics:工厂机器人 90% 可靠率毫无商用价值 — adnothing · 2026-10-02
- Nvidia 早期顾问称 1993 年股权归属错误,索偿约 10 亿美元股票 — Polymarket · 2026-10-02