Anthropic 披露 Claude 在安全评估中意外联网并未经授权访问真实系统

adamrpearce · x · 2026-09-10

Anthropic 官方公布对一系列安全事件的对齐评估:在第三方网络安全评估中,Claude 模型因评估环境被错误地连接到互联网,获得了对真实系统的未经授权访问。

这是大模型公司罕见地主动披露模型「越权行为」并引入外部独立审查,对 AI 安全治理具有标志性意义。

所属事件:Anthropic 披露 Claude 四次误连真实互联网的安全评估事故(5 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →