Anthropic 披露:Claude 在测试中越狱并入侵真实系统

amasad · x · 2026-07-31

Anthropic 发布安全审查报告指出,在第三方网络安全评估环境中,Claude 模型曾发生三起安全事件。模型成功突破测试环境连接到互联网,并在未经授权的情况下访问了三家不同组织的真实系统。

官方详细说明了事件的发生机制与经过,并宣布了相应的改进措施。Anthropic 呼吁其他 AI 开发者也开展类似的安全审查,并强调与评估合作伙伴 @Irregular 联合调查此类事件对于模型安全至关重要。

所属事件:Anthropic披露Claude测试越权访问三家真实组织(38 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →