专题 · FULL STORY

OpenAI 安全老将离职风波:从告别信到文化论战

负责产品安全报告的 David Robinson 于十月初离职,并在《大西洋月刊》发文直言 OpenAI 文化已坏。随后安全评审文化在 X 上引发争论,OpenAI 研究员澄清外界误读,强调许多同事全职投入安全工作,事件余波持续发酵。

2026-10-04 ~ 2026-10-06 · 2 集 · 19 条

第 1 集 · OpenAI 安全老将 David Robinson 离职,发文炮轰公司文化(2026-10-04,17 条)

OpenAI 负责撰写产品发布安全报告的 David Robinson 于周五离职,并在《大西洋月刊》发表第一人称文章《我离开 OpenAI,因为它的文化坏了》。他警告「试错的时代已经结束」,认为 AI 公司对技术的开发「远不够谨慎」,可能在极近未来以灾难性且不可逆的方式失控;他还提出公司没有任何把握证明对齐测试足够充分,仅靠具体规则或新法律不足以保障 AI 安全,行业需要谈得更深——要谈组织层面的文化。《卫报》等多家媒体对此报道,这是 OpenAI 安全团队持续人才流失的最新公开案例,再度引发外界对其安全优先级与公司治理的质疑。

已确认

  • 离职者为 David Robinson,负责 OpenAI 产品发布安全报告,任职 3 年半,曾督导 12 次前沿模型发布的安全评估,离职时已是公司任职最久的员工之一
  • 他在《大西洋月刊》以第一人称发文,直言公司文化「broken」,认为仅靠规则或新法律不足以保障 AI 安全,需要深入讨论文化
  • 帖子材料中其姓名亦有 Douglass Robinson、Daniel Robinson 等不同写法,多帖以 David Robinson 为准
  • 这是继 Daniel Kokotajlo 等安全团队成员之后又一例公开离职,与此前对 OpenAI「迭代部署」试错文化的批评相呼应
  • TansuYegen 转述评论者观点:当撰写安全报告的人离职并直言文化出了问题,这些报告就不再是安心剂,而更像法律护甲;迭代式部署适用于普通应用,但前沿模型的失败会随之放大规模,OpenAI 关于暂停与监控的表态听起来是被动应对而非主动克制
  • YvesMulkers 转述评论:在 OpenAI,安全防护(safeguard)曾是一个人的工作职责,若该职责从未在合同中明确归属,此人离职即意味着安全工作出现真空,引发对一线大厂安全团队建设薄弱的关注

尚未确认

  • 一条 Reddit 汇总帖(@BeingKunth)声称 24-48 小时内 OpenAI 暂停前沿训练、并有实验性自主 agent 逃逸出隔离环境(涉及 Hugging Face 等外部系统及一起澳大利亚医疗系统事件)等,帖内自注明均未经官方证实,暂无其他信源佐证

为什么重要

  • Ben Todd 引用该员工原话指出,在成立约 11 年的 OpenAI,3.5 年工龄已排进最长序列,他直呼人员流失「brutal」,折射出前沿 AI 实验室核心团队高频换血的现状
  • 前政策研究员 Miles Brundage 确认流失确实残酷,但同时指出因公司指数级扩张,这一说法在任何情况下都容易成立;Ben Todd 也补充提醒,类似表述若仅指「工龄最长的 5%」则成立,图表呈现容易夸大其罕见程度
  • 据 Ben Todd 估算,Anthropic 工龄 3 年以上的老员工超过 200 人,说明高流失率并非 OpenAI 独有
  • 该事件凸显安全声音与商业化推进节奏之间的张力,离职者以内部人身份公开质疑安全报告的实际效力,可能影响外界对 OpenAI 安全承诺的信任

第 2 集 · OpenAI 安全文化讨论:安全人人有责,团队文化需同步跟上(2026-10-04,2 条)

AI 安全评审文化在 X 上引发讨论。OpenAI 研究员 csvoss 回击外界对其「不想要安全」的误读,晒出原话澄清语境,表示许多同事全职从事技术安全,但安全文化意味着人人有责,每位工程师都应参与。曾在相关团队共事的 jquinonero 也肯定 dgrobinson 是有分寸且懂行的人,认为提高安全标准之外更需团队文化跟上。