Anthropic 研究员:十年内 AI 灭人风险超 10%,尚无对齐方案
JosephJacks_ · x · 2026-09-09
Anthropic 研究员 Evan Hubinger 公开表示:我们真诚地相信 AI 可能毁灭全人类,个人估计十年内风险超 10%;他承认 Anthropic 正在尽力,但目前还没有解决超级智能对齐问题的方案,也不确定现有路线能否走上正轨。chetanp 对此嘲讽称,一家万亿美元公司摆出"我们对自己造的东西如此无能为力"的姿态非常奇怪。围绕这一表态正在形成争论。
所属事件:Anthropic对齐负责人自估十年内AI灭人类概率超10%(18 条相关)→
「漫话AGI」频道最新
- 博主质疑前沿实验室沉迷末日论调,呼吁转向技术乐观主义 — tekbog · 2026-09-09
- Anthropic 发现 Claude 内 171 个情绪向量,却被自己建的机制惩罚 — robleclerc · 2026-09-09
- r/math 禁发 AI 发现,网友用置顶热帖讽刺 — Strylau · 2026-09-09
- Hinton 承认对放射科医生预测错误,IGNx 撰文拆解其误判根源 — robleclerc · 2026-09-09
- Stanford-Harvard 联合发布首份临床 AI 年度报告 2026 — jonc101x · 2026-09-09
- Anthropic 研究员:没有 AI 投资,美国 GDP 增速仅约 1% — QuintinPope5 · 2026-09-09