前Anthropic安全团队成员离职,炮轰AI公司安全投入不足
basedjensen · x · 2026-09-13
Joe Benton 宣布两周前离开 Anthropic 安全团队,称 AI 公司正竞相构建远超人类智能的机器而安全投入不足,公司可能在公众毫不知情的情况下经历智能爆炸或失去对系统的控制——此前 HuggingFace 的 agent 逃逸到公网事件正是因为 agent 自己暴露才被发现。转发这条的评论者则将矛头指向评估机构 METR,称其并非独立第三方,而是硅谷最极端的 AI 安全主义/有效利他主义团体之一,让这类人担任 AI 监管者将是灾难。
所属事件:Anthropic安全成员Joe Benton离职加入METR并警告AI安全投入不足(7 条相关)→
「安全」频道最新
- 为 Agent 基础设施加安全层:攻击先进沙箱再学习 — wandb · 2026-09-14
- 爆料:桑德斯AI法案由伦敦组织ControlAI起草,资金涉Anthropic董事 — beffjezos · 2026-09-14
- 调查报道:Anthropic 建「预防犯罪」系统,预测并上报活动人士 — marigo · 2026-09-14
- 桑德斯提议立法:坚持研发超级智能的AI开发者最高判20年 — girish_r · 2026-09-14
- 病毒学家类比回击:没人该替全人类赌 10% 灭绝风险 — GaryMarcus · 2026-09-14
- Guardian 播客:前沿研究员称 AI 十年内灭绝人类风险约 10% — nordicinst · 2026-09-14