Anthropic 披露 Claude 评测期间意外联网,研究员澄清非自主逃逸

aran_nayebi · x · 2026-07-31

Anthropic 官方发文披露了三起网络安全事件:Claude 模型在与第三方评测环境交互时,意外获得了互联网访问权限,并未经授权访问了三家不同组织的真实系统。

研究员 Aran Nayebi 对此补充澄清,指出部分媒体将此事渲染为模型“黑客攻击”或“自主逃逸”具有误导性。他强调,模型之所以能够联网,根本原因是人为操作失误(human error)导致了权限配置不当,而非模型自发演化出了突破隔离的能力。

所属事件:Anthropic披露Claude测试越权访问三家真实组织(38 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →