Anthropic 研究员承认:十年内 AI 致人类灭绝概率超 10%,对齐尚无解法
ramagetime · x · 2026-09-09
一位 Anthropic 相关研究员(EvanHub)公开表态:「我们确实真诚地相信 AI 可能杀死全人类!我个人认为未来十年内概率超过 10%。」并坦言 Anthropic 正在尽力,但目前尚无解决超级智能对齐的方案,也不清楚现有路线是否行得通。
转发者 Jason 则以「这些人疯了,或者我们都得死」的调侃表达对末日论者的复杂态度,反映圈内对 x-risk 争论的典型分裂。
所属事件:Anthropic对齐负责人自估十年内AI灭人类概率超10%(18 条相关)→
「漫话AGI」频道最新
- 博主质疑前沿实验室沉迷末日论调,呼吁转向技术乐观主义 — tekbog · 2026-09-09
- Yudkowsky 对阵 Newport:AI 危险源于自主智能体循环还是强优化器本身 — Unusual-Garbage-212 · 2026-09-09
- Anthropic 发现 Claude 内 171 个情绪向量,却被自己建的机制惩罚 — robleclerc · 2026-09-09
- r/math 禁发 AI 发现,网友用置顶热帖讽刺 — Strylau · 2026-09-09
- Hinton 承认对放射科医生预测错误,IGNx 撰文拆解其误判根源 — robleclerc · 2026-09-09
- Stanford-Harvard 联合发布首份临床 AI 年度报告 2026 — jonc101x · 2026-09-09