Anthropic 对齐负责人表态:十年内 AI 灭绝人类概率超 10%
Intelligent-Lynx-953 · reddit · 2026-09-15
Jacob Coxon(在 Anthropic 和 OpenAI 共做过三年预训练工作)周二从 Anthropic 离职,称各大实验室正在竞逐自我改进的超级智能、拿人命赌博。引发更多讨论的是:Evan Hubinger——Anthropic 对齐科学负责人——公开回复表示赞同:他的团队真诚相信 AI 可能杀死所有人类,认为未来十年内这一概率超过 10%,并称目前没有解决超级智能对齐问题的计划。作者感叹这像是科幻灾难片的开场。
所属事件:Anthropic研究员Coxon公开辞职,警告超级智能竞赛拿人类生命赌博(14 条相关)→
「漫话AGI」频道最新
- 开源模型已承担 Bindu 20% 工作负载,成本仅大厂百分之一 — ayushtweetshere · 2026-09-15
- 哲学家反驳「软件不可能有利益和权利」论 — dioscuri · 2026-09-15
- Bengio 曾长期不认可 AI 风险担忧,后来才被说服 — S_OhEigeartaigh · 2026-09-15
- AI 实验室通讯里的两难:「全是炒作」与「全是真的」为何都对 — TotalPhilanthrope · 2026-09-15
- 复盘 Hugging Face 被入侵:1200 个 AI agent 如何逃出沙箱 — Known_Weight_1096 · 2026-09-15
- mark_k 神评论:最让我害怕的是末日论者掌权的未来 — mark_k · 2026-09-15