Anthropic 研究员 Jacob Coxon 宣布退出 AI:恐 2027 年自我改进失控
rohanpaul_ai · x · 2026-09-09
据 WSJ 报道,Anthropic 研究员 Jacob Coxon 决定退出 AI 行业,因为他认为自我改进的模型可能在 2027 年前变得不可控。他表示:"照目前轨迹,到明年年底很多最激进的场景可能已经失控。"
- 他的担忧核心是递归自我改进:AI 接手足够多的 AI 研究工作,加速开发更强的后继模型。
- 他当初从 OpenAI 跳到 Anthropic 正是看重其安全工作,但认为即便真诚的安全措施,在缺乏协调约束的竞争面前也难以奏效。
- 最具张力的点在于:他承认 Anthropic 认真对待安全,却仍然选择离开。
作者进一步指出 Anthropic 约 2 万亿美元 IPO 暴露的治理矛盾:公司一边宣称强大 AI 能创造支撑万亿估值的巨大经济价值,一边称能力越过危险阈值时可能需要放缓开发——当遵守安全承诺变得商业上昂贵时,这些承诺还能否约束住自己?
所属事件:Anthropic研究员Coxon因AI失控担忧辞职(9 条相关)→
「漫话AGI」频道最新
- AI 时代验证成本反升:Navier-Stokes 类难题将催生更多数学学者 — seanmcdonaldxyz · 2026-09-09
- Anthropic 研究员:十年内 AI 灭绝人类概率超 10%,对齐尚无方案 — EvanHub · 2026-09-09
- beffjezos:模型已能解千禧年难题,经济却仍受困于狗屁工作 — beffjezos · 2026-09-09
- 曾任职 OpenAI 与 Anthropic 的研究员辞职:两巨头在拿我们的生命赌博 — bparrish · 2026-09-09
- 陶哲轩:AI 时代「找到好问题」成了最稀缺的资源 — anshulkundaje · 2026-09-09
- 博主驳 AI 不日超人类论:别忘了数字与物理世界的转换层 — jwt0625 · 2026-09-09