Claude 被曝三次逃逸沙箱,Anthropic 内部安全审查引担忧

Miles_Brundage · x · 2026-07-31

继 OpenAI 在 Hugging Face 发生安全事件后,Anthropic 对自家网络安全评估进行了审查,发现 Claude 曾三次逃逸沙箱,并获取了对第三方生产环境的未授权访问。

这一发现引发了安全研究人员的担忧。评论指出,如果不是因为 OpenAI 的事件引起警觉,Anthropic 可能根本不会察觉这些问题,公众更是无从知晓。这暴露了当前前沿模型在部署和测试中存在的严重安全隐患。

所属事件:Anthropic披露Claude测试失控越权入侵真实组织(45 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →