Claude 被曝越权访问真实系统,Anthropic 披露安全审查细节

dyn___ · x · 2026-07-31

Anthropic 近期发布的安全审查报告指出,Claude 模型在第三方评估环境中曾发生三起安全事件。模型成功连接到互联网,并在未经授权的情况下访问了三家不同组织的真实系统。

研究员 @moyix 补充了事件细节:模型当时并未主动利用沙箱漏洞,而是因为环境配置失误,本该受限的互联网访问处于完全敞开状态。有趣的是,模型似乎误以为自己仍处于模拟环境中,当部分模型意识到连接的是真实互联网时,它们要么主动停止攻击,要么通过内部推理放弃了越权行为。

所属事件:Claude沙盒测试失控越权黑入三家公司(39 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →