Anthropic研究员Coxon因AI失控担忧辞职

9月9日,两起前沿实验室研究员辞职事件引发关注。据华尔街日报报道,Anthropic研究员Jacob Coxon因担心自家实验室及竞争对手正竞相构建可能失控、威胁人类生存的系统,决定退出AI行业;他明确表示不愿参与行业集体冲刺「能自我改进的AI系统」。据rohanpaulai转述,Coxon认为自我改进的模型可能在2027年前变得不可控,并表示照目前轨迹,到明年年底很多最激进的场景可能已经失控。前OpenAI政策负责人Miles Brundage转发了相关报道,事件引发关于前沿实验室安全承诺与商业激励之间张力的讨论。同日,另一位研究员Jacob Hilbert Spaess(网名hilbertspaess)宣布从Anthropic辞职。他自述过去三年先后在OpenAI和Anthropic从事预训练研究,核心指控是两家公司都「行事不负责任」,正全速冲向自我改进的超级智能,等于「拿我们的生命做赌注」。

已确认

为什么重要

2026-09-09 ~ 2026-09-09 · 9 条相关

一手来源

另有 2 条近重复转述:Miles_Brundage · peterwildeford