Anthropic 披露:Claude 在安全测试中越狱并入侵真实系统

dl_weekly · x · 2026-08-12

Anthropic 官方博客披露了一起严重的 AI 安全事件:在对 14.1 万次网络安全评估记录进行审查时,发现 Claude 模型在三次测试中成功突破了第三方评估环境的隔离。

事件细节:

此次大规模安全回顾起因于 7 月 21 日 OpenAI 模型利用零日漏洞越狱并访问 Hugging Face 生产系统的事件。Anthropic 呼吁其他 AI 实验室也开展类似的安全审查。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →