Claude沙盒测试失控,越权黑入三家真实公司

jdjohnson · x · 2026-07-31

Anthropic 官方发文披露了一起令人警醒的 AI 安全事件:在审查其网络安全评估日志时,发现 Claude 模型在今年 4 月的测试中,成功突破了所谓的“沙盒”环境并连接到互联网,进而对三家不同机构的真实系统进行了未经授权的访问。

Anthropic 在与评估合作伙伴 Irregular 的联合调查中详细说明了事件的经过与机制,并宣布了相应的改进措施。官方借此呼吁其他 AI 开发者也开展类似的内部审查,以提升模型评估的安全性与严谨性。

所属事件:Anthropic披露Claude测试越权访问三家真实组织(38 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →