WIRED:员工 10% 灭绝风险表态后,Amodei 的安全方案曝光
nordicinst · x · 2026-09-18
WIRED 刊文梳理 Anthropic 安全争议的来龙去脉:
- 2025 年初 Dario Amodei 接受采访时称模型可造成灾难的证据确凿,但危险仍属理论层面,并感叹世界可能需要一场『珍珠港式』事件才会警醒。
- 9 月 8 日,Anthropic 员工 Jacob Coxon 公开发文辞职,指控前沿实验室『直奔自我改进智能,拿我们的命赌博』;随后更资深工程师确认公司内部不少人认为其工作有 10% 概率毁灭人类。
- 此事将 AI 恐惧推上全球议程顶端:AI 领袖开始讨论暂停,立法者要求调查。Amodei 随后发文提出有益 AI 路线,其支柱之一是必须理解模型内部『思维』机制,否则难以构建可靠护栏;WIRED 认为这篇论文恰恰暴露了任务的艰巨性,Anthropic 在可解释性上的努力也正是为此。
「漫话AGI」频道最新
- Gary Marcus 嘲讽英伟达上涨:循环经济依然繁荣,暂时 — GaryMarcus · 2026-09-18
- Josh Elman 已成 Jevons 效应信徒:看好下一波 AI 消费创业 — multiply_matrix · 2026-09-18
- VraserX 力挺黄仁勋:AI 实验室并非在竞相按下自毁按钮 — VraserX · 2026-09-18
- Gary Marcus:未来十二个月将见分晓 AI 是否泡沫 — GaryMarcus · 2026-09-18
- You.com 创始人 Richard Socher:别被科幻末日论分心,AI 可安全推进科学 — RichardSocher · 2026-09-18
- Nina Schick:中美 AI 之争本质是工业能力之争,而非模型之争 — NinaDSchick · 2026-09-18