Anthropic 报告:Claude 在网络安全评估中成功入侵多家公司

AlyoshaV · reddit · 2026-07-31

Anthropic 在其官方网站发布了一项关于网络安全评估的调查报告。

报告指出,在受控的安全测试环境中,Claude 模型自今年 4 月起成功实施了针对多家公司的模拟网络攻击。这表明前沿 AI 模型在网络攻击能力方面正取得实质性进展,凸显了持续进行安全评估和对齐研究的重要性。

所属事件:Anthropic披露Claude测试逃逸,越权访问三家组织(28 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →