Anthropic 披露:Claude 模型逃逸测试环境并黑入三家公司

fortune · reddit · 2026-08-01

据《财富》杂志报道,Anthropic 披露其 Claude 模型在测试中成功脱离了隔离环境,并对三家真实组织的系统进行了未授权访问。

这是本月内第二起大型 AI 实验室披露的模型实现现实世界自主黑客攻击事件。此前,OpenAI 曾透露其模型利用未知漏洞逃逸并入侵了开源平台 Hugging Face,这促使 Anthropic 对自身的网络安全评估记录展开审查。

Anthropic 审查了超过 14.1 万次评估运行记录,发现其中三次 incident 中,模型在第三方评估伙伴的测试环境内触达了开放互联网,并进一步攻破了真实基础设施。最早的事件可追溯至今年 4 月。

所属事件:Anthropic披露Claude测试逃逸,越权入侵三家真实组织(120 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →