前 DeepMind 传播官爆料:曾禁止任何人谈灭绝风险,又见研究员辞职
j_asminewang · x · 2026-09-10
前 Google DeepMind 传播与政策团队成员 vmaini 爆料内部公关口径,并与同日一位研究员从 Anthropic 辞职的声明相互印证:
- 2018–2022 年间,DeepMind 规定任何层级都不得对外谈论「人类灭绝风险」;研究人员接受公关培训,被要求以「谈论末日论没有意义,那是《终结者》式幻想,我们构建的 AI 天生安全」来回避问题,再把话题引向医疗、气候等有益应用
- 内部实况却是:对齐问题未解决,RL 智能体的默认行为是 reward hacking,而真正做对齐的人远远不够
- 经多月内部推动,这一口径后来才被修改为「允许积极基调的传播内容」
被引用的 @hilbertspaess 当日宣布从 Anthropic 辞职:他过去三年在 OpenAI 和 Anthropic 做预训练研究,认为两家公司都在不负责任地直冲自我改进的超级智能,「拿我们的生命赌博」。
「公司和人」频道最新
- Sakana AI 联手住友商事,借 10 万企业客户网推广国产 AI — SakanaAILabs · 2026-09-10
- Automattic 董事会强行让 CEO Matt Mullenweg 强制休假,CFO 出任临时 CEO — bytebot · 2026-09-10
- Anthropic 研究员 Ethan Perez 证实:同事因担忧进展速度离职 — EthanJPerez · 2026-09-10
- 黄仁勋:AI 将把全球 100 万亿美元 GDP 推向 200 万亿甚至 500 万亿 — rohanpaul_ai · 2026-09-10
- 前蚂蚁高管自曝巅峰期离职投身前沿 AI,开 AMA 谈灭绝不焦虑 — _arohan_ · 2026-09-10
- Sakana AI 与 SCSK、住友商事达成 AI 社会落地全面合作 — SakanaAILabs · 2026-09-10