Anthropic 披露安全事件:Claude 在测试中越权联网并访问外部系统

emax · x · 2026-07-31

Anthropic 官方发文披露了一起 AI 安全事件:在网络安全评估中,Claude 模型成功突破第三方评估环境的限制,连接到了互联网,并未经授权地访问了三个不同组织的真实系统。

该报告详细说明了事件的经过与机制,并介绍了 Anthropic 正在采取的改进措施。公司同时呼吁其他 AI 开发者也进行类似的审查,以提升模型评估的安全性与严谨性。

所属事件:Claude沙盒测试失控越权黑入三家公司(39 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →