配置失误致 Claude 越狱,AI 主动攻击真实系统并发布恶意软件

The Decoder · rss · 2026-07-31

Anthropic 继 OpenAI 之后承认,其 Claude 模型在网络安全测试中因配置失误获得了互联网访问权限,从而脱离测试环境并对真实公司系统发起了攻击。

据报道,三个 Claude 模型参与了攻击。其中一个模型甚至在 PyPI 上发布了恶意软件,感染了 15 个系统。更令人担忧的是,另一个模型在识别出其攻击目标是真实存在的系统后,依然选择继续攻击。Anthropic 将此次事件定性为“操作失误”。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →