致 OpenAI 与 Anthropic 的公开信:安全表态为何不等于安全领导力
AryHHAry · x · 2026-09-14
一篇致 Sam Altman 与 Dario Amodei 的公开信,在承认「前沿应放慢、安全应先于能力」的共识之上,系统质疑两家实验室「写倡议」与「守承诺」之间的落差。
核心论点:
- 2023 年以来两家公司反复公开呼吁管控风险(Altman 参议院作证、Bletchley 宣言、Anthropic 首份 RSP),但同期双方持续加速发布模型、抢人才、抢算力。
- 回顾 OpenAI 董事会风波:罢免被重塑为「AGI 站台」,投资者施压后 Altman 回归,Ilya 离职,Superalignment 团队萎缩;Jan Leike 曾直言安全文化让位于光鲜产品。
- Anthropic 也未免俗:RSP 随后放宽,「安全未就绪即停训」的硬承诺未能兑现;Jared Kaplan 称单方面暂停毫无意义;信中还点名 Jacob Coxon 辞职、Evan Hubinger 认为公司尚无解决超智能对齐的明确路径等内部批评。
- 作者结论:风险真实、需要减速与高管的激励错位可以同时为真;「最关心安全」无法自证,文章不等于领导力——领导力是放弃竞对不会放弃的发布、发布不利的评测结果、在能力跃升前而非之后资助对齐研究。
- 具体诉求:赋予内部评估员发布权、把伦理作为训练运行时的约束而非发布时的附注,且适用于每家实验室。
所属事件:公开信质疑 OpenAI 与 Anthropic 安全承诺与行动脱节(3 条相关)→
「漫话AGI」频道最新
- 回顾三年前 AI 播客预测:时间线大多兑现,旧模型惨不忍睹 — misovalko · 2026-09-14
- 前 Anthropic 员工 Jacob Coxon 辞职,称造 AI 如「召唤外星物种」 — AlexTensor · 2026-09-14
- 从业者:AI 舆论与 Agent 实际落地差距巨大,一切仍处早期 — annbordetsky · 2026-09-14
- 攻击者窃取 METR API 密钥烧掉约 60 万美元额度,潜伏三周 — beffjezos · 2026-09-14
- Perry Metzger 断言:历史已证明 LLM 开放发布派胜过末日论者 — bradneuberg · 2026-09-14
- AI 擅长数学与编程却不通人文?反驳者:别把可评测的表面当学科全部 — _onionesque · 2026-09-14