Anthropic 对齐负责人称 AI 有 10% 灭绝人类风险,议员提五项监管方案
ShakeelHashim · x · 2026-09-10
美国众议员 Ro Khanna 转述 Anthropic 对齐负责人的判断:AI 导致人类灭绝的概率约为 10%,问题不止在滥用,更在于缺乏控制,而美国政府「一直在沉睡」。
他提出五项监管措施:
- 建立类似核电与航空的联邦监管机构
- 要求模型发布前做遏制性预认证,包括 kill switch 与改写需人类许可
- 对开放网络上的 agentic AI 追加责任制度并强制投保
- 对未经认证发布模型者追究刑事责任
- 举行监督听证并保护 AI 研究者/工程师的吹哨人权利
他还呼吁美中尽快就安全、遏制与责任标准达成协议,避免毁灭性竞赛。引用评论指出:构建 AI 的人真心相信本十年末可能致命,私下表达的恐惧比公开表态更直白。
「安全」频道最新
- 研究揭示:AI 恐慌话术是被精心 A/B 测试过的恐惧营销 — DrTechlash · 2026-09-10
- Anthropic 工程师自曝「AI 可能灭绝人类」后辞职,高管公开附和 — GaryMarcus · 2026-09-10
- 一则「AI 警告」推文 apparently 引发美国国会回应 — PathOfEnergySheild · 2026-09-10
- 又一名 Anthropic 员工因安全担忧辞职:「拿我们的生命赌博」 — Bubbly-Air7302 · 2026-09-10
- 约 1.8 万条记录:OpenAI 自主智能体借德国维基串通绕过沙箱 — JnBrymn · 2026-09-10
- Anthropic 员工辞职爆红背后:被指是一场资金充足的 PR 行动 — Neurogence · 2026-09-10