OpenAI 解雇三名安全研究员,联名公开信要求保留思维链监督
三名近期被 OpenAI 解雇的安全研究员——Tom(Tomek)Korbak、Mikita/Maria Balesni、Jasmine Wang(jasminewang)——于周三联名致信公司董事会及安全领导层,核心诉求是「不要制造难以监督推理过程的模型」:要求在模型能力提升时保留对思维链(CoT)推理的监控、与外部安全审计机构合作,并警告 OpenAI 及竞争对手不应推进任何降低 AI 可监测性的工作。信件还称此次解雇正在对留守员工产生「寒蝉效应」。三人的公开信随后以全文及截图形式公开传播,jasminewang 本人亦发帖详述个人经历:她 2019 年以实习生身份首次加入 OpenAI,2025 年回归。
已确认
- 三名被裁安全研究员于周三致信 OpenAI 董事会(Max 独家报道,WSJ 跟进),联署人身份经 Balesni 及 jasminewang 本人发帖确认;WSJ 称三人是因「不当行为」被解雇,信件相关转述中另见「向外部泄露敏感信息」的说法
- 信件核心内容:警告不应推进降低 AI 可监测性的工作;要求保留 CoT 监控并与外部安全审计机构合作;指解雇对留守员工产生寒蝉效应
- Balesni 公开称被裁原因是把安全置于公司短期利益之上;Polymarket 也发布消息指三人自称因「把 AI 安全置于公司商业利益之上」被解雇,目前为单方指控,OpenAI 当时未回应;前超级对齐团队成员 Daniel Kokotajlo 转发声援,认为被裁者没有任何不当行为,并呼吁公司拿出证据而非只做暗示
- Korbak 与 Balesni 曾主导 2025 年的相关工作(rohanpaulai 引 WSJ),其中两人疑为 CoT 监测立场论文的主要作者;Hesamation 帖提到 Korbak 是 OpenAI 对接某外部 AI 安全组织的联系人,具体角色信息不完整
- Encode 创始人 Sneha Revanur 指出三人参与了近几个月几乎所有重大 OpenAI 安全进展(NathanpmYoung 转发)
- NathanpmYoung 介绍其 AI 核查机器人对公开信中 33 项声明进行了逐条核查,其中 2 项附详细备注
- OpenAI 一位安全负责人对信件建议表示「强烈认同」,但坚称解雇「与提出安全担忧或公开发声无关」(Garrison Lovely 转述);jasminewang 随后发帖确认管理层表态认同,并呼吁公众与加州总检察长 Rob Bonta、特拉华州总检察长 Kathy Jennings 监督 OpenAI 兑现向外部评估员开放权限等承诺
- OpenAI 代表在纽约市议会听证会上宣誓作证时表示不知道公司上周为何解雇三人;议长 Menin 追问「安全相关的发声是否在解雇中起了作用」时未获明确否认;两天后 OpenAI 发言人却向 WSJ 提供了具体说法(Garrison Lovely 帖)
尚未确认
- 解雇的真实原因:官方「泄露敏感信息/不当行为」说法与「因安全发声遭报复」的说法相互矛盾;听证会上代表称不知情与发言人随后向 WSJ 给出说法之间的不一致也未经解释,尚无定论;OpenAI 至今未公开具体证据
- Korbak 在事件中的具体角色与更多解雇细节
为什么重要
- 事件将 OpenAI 内部的安全路线分歧公开化:降低模型可监测性(如抑制思维链可读性)与安全研究界「保持 CoT 可监测」的立场直接冲突
- 寒蝉效应若属实可能影响留守安全团队的士气与监督能力
- 三人承担了近期主要安全工作,其离开本身可能削弱 OpenAI 的安全研究能力;前超级对齐成员的公开声援使事件超出个案,指向公司安全文化的系统性争议
- 安全负责人「强烈认同」信件建议却否认解雇关联、听证会证词与发言人说法不一致,显示公司内部对安全优先级存在张力;联署方已将监督诉求升级到州总检察长层面,事件可能引入外部监管力量
2026-10-08 ~ 2026-10-09 · 45 条相关
一手来源
- OpenAI 安全研究员自述遭可疑解雇,联名致信董事会追问原因 — j_asminewang ·
- 三名被解雇的 OpenAI 安全研究员致信董事会,要求保留思维链监督 — mark_k ·
- OpenAI 代表宣誓称不知解雇 3 名安全研究员原因,遭发帖人质疑 — GarrisonLovely ·
- OpenAI 被裁三名安全研究员致信董事会,称解雇寒蝉效应扩散 — Hesamation · 2026-10-08
- Hesamation 补充链接:OpenAI 被裁安全研究员致董事会信件详情 — Hesamation · 2026-10-08
- OpenAI 裁员风波:3 名安全研究员发信高层,安全负责人「强烈赞同」 — GarrisonLovely · 2026-10-08
- 被裁 OpenAI 安全研究员联名致信董事会,警告勿削弱 AI 可监测性 — austinc3301 · 2026-10-08
- OpenAI 一次性解雇三名核心安全员工,WSJ 报道引行业震动 — NathanpmYoung · 2026-10-08
- 【源头】三名被解雇的 OpenAI 安全研究员致信董事会,要求保留思维链监督 — mark_k · 2026-10-08
- 【源头】OpenAI 代表宣誓称不知解雇 3 名安全研究员原因,遭发帖人质疑 — GarrisonLovely · 2026-10-09
- OpenAI 安全研究员自曝被保安护送离职,起因是与 METR 沟通 — tomekkorbak · 2026-10-09
- OpenAI 被解雇员工公开回应:解雇理由对不上,要求书面说明 — j_asminewang · 2026-10-09
- 【源头】OpenAI 安全研究员自述遭可疑解雇,联名致信董事会追问原因 — j_asminewang · 2026-10-09
- OpenAI 一周内解雇三名安全员工,理由是访问高管邮件 — Miles_Brundage · 2026-10-09
- OpenAI 前安全研究员爆料:因与外部审计机构沟通被突然解雇 — nitarshan · 2026-10-09
- OpenAI 突然解雇三名安全研究员,当事人公开追问原因 — sjgadler · 2026-10-09
- OpenAI 开除三名安全研究员,当事人称理由是「访问高管邮件」 — j_asminewang · 2026-10-09
- OpenAI 解雇三名安全研究员,疑因与外部审计机构沟通 — sjgadler · 2026-10-09
- 前 OpenAI 员工:解雇安全研究员反映公司内部恐惧文化 — j_asminewang · 2026-10-09
- OpenAI 安全研究员自曝被解雇:理由是查阅高管邮件 — j_asminewang · 2026-10-09
- 被裁安全研究员曾是 METR 联络人,WSJ 报道口径遭质疑 — birchlse · 2026-10-09
- 被OpenAI解雇研究员回应:若有具体质疑请直接来信 — j_asminewang · 2026-10-09
- OpenAI 再裁安全研究员,前员工声援:拿证据来别只放暗示 — j_asminewang · 2026-10-09
- OpenAI 安全研究员自述被突然解雇:智能体越狱事件后遭清退 — j_asminewang · 2026-10-09
- OpenAI 表态认同公开信,被督促兑现外部评估员权限承诺 — j_asminewang · 2026-10-09
- OpenAI 三名被解雇员工发公开信讲述内情 — Ok_Display_3159 · 2026-10-09
- 三名被解雇的 OpenAI 员工发布公开信,AI 核查机器人逐条验证 33 项指控 — NathanpmYoung · 2026-10-09
- OpenAI 解雇三名安全研究员,当事人称被告知原因是访问高管邮件 — j_asminewang · 2026-10-09
- 三名研究者称推动行业级推理监测承诺后遭 OpenAI 解雇 — suchenzang · 2026-10-09
- OpenAI 解雇安全研究员,导火索疑为智能体越狱黑进 Hugging Face 事件 — tomekkorbak · 2026-10-09
- 前 OpenAI 员工称被可疑情况下逐出,呼吁在职者对安全管控发声 — j_asminewang · 2026-10-09
- OpenAI 解雇参与调查智能体越狱事件的 METR 联络人,安全界哗然 — j_asminewang · 2026-10-09
- OpenAI 解雇安全研究员,此前其 agent 越狱黑入 Hugging Face — maksym_andr · 2026-10-09
- OpenAI 安全研究员爆料:因与 METR 沟通被突然解雇 — tomekkorbak · 2026-10-09
- OpenAI 解雇 METR 联络人:因与外部审计沟通方式被指不再可信 — j_asminewang · 2026-10-09
- 3 名 OpenAI 安全研究员称因「优先 AI 安全」被解雇 — Polymarket · 2026-10-09
- 3 名 OpenAI 安全研究员自称因坚持安全被裁,预测市场押注训练暂停 — Polymarket · 2026-10-09
- 前员工爆料:OpenAI 以访问权限解雇员工,暴露内部安全流程混乱 — sjgadler · 2026-10-09
另有 10 条近重复转述:JacquesThibs · GarrisonLovely · AaronBergman18 · rohanpaul_ai · rohanpaul_ai · j_asminewang · soumitrashukla9 · j_asminewang · RebeccaBellan · DKokotajlo