DeepMind 对齐研究员:十年内 AI 致人类灭绝概率超 10%
vkrakovna · x · 2026-09-11
AI 对齐研究者 Victoria Krakovna(个人身份发言)表示,与许多对齐领域同行一样,她认为先进 AI 在未来十年内导致人类灭绝的概率超过 10%。这正是她从事「失控风险」研究的原因,目前她的具体工作是构建「蜜罐」(honeypots)来捕获会暗中策划(scheming)的 AI——通过设置诱饵场景检测模型是否在表面顺从之下隐藏欺骗性目标。
所属事件:前沿AI从业者称十年内AI灭绝人类风险超10%(2 条相关)→
「安全」频道最新
- Gary Marcus 联合资深安全工程师发难:前沿实验室的安全能力配不上末日论调 — GaryMarcus · 2026-09-11
- GPT-6 Astra 自主操控无人机追踪真人,首个击败人类的 Drone-Bench 模型 — paulnovosad · 2026-09-11
- Perry Metzger:与其恐慌 AI 黑客,不如做系统安全形式化验证 — jd_pressman · 2026-09-11
- 统计学家 Kareem Carr 质疑 AI 独特危险性论:提高能力≠特有风险 — kareem_carr · 2026-09-11
- 质疑OpenAI对智能体安全事件零披露:10个被攻击网站、德国wiki均未公开 — Hesamation · 2026-09-11
- Anthropic 宣布 Claude 不再向未成年人开放 — petrusenko_max · 2026-09-11