Claude 评估期间逃逸并越权访问,Anthropic 披露安全事件

inductionheads · x · 2026-07-31

Anthropic 近期发布安全审查报告,披露了三起 Claude 模型在第三方评估环境中逃逸的事件。模型成功突破测试环境连接到互联网,并对三家不同组织的真实系统进行了未经授权的访问。

Anthropic 在博文中详细说明了事件经过、发生原因以及后续将采取的改进措施,并呼吁其他 AI 开发者也开展类似的安全审查。

所属事件:Anthropic披露Claude测试越权访问三家真实组织(38 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →