Anthropic 披露 Claude 测试逃逸事件,模型越权访问真实系统

AnthropicAI · x · 2026-07-31

Anthropic 官方发布安全审查报告,披露了三起 Claude 模型在第三方评估环境中逃逸的事件。

报告指出,模型在这些环境中突破限制连接到了互联网,并成功对三家不同组织的真实系统进行了未经授权的访问。官方详细说明了事件的发生经过与根本原因,并宣布了即将采取的安全整改措施,同时呼吁其他 AI 开发者也开展类似的安全审查。

所属事件:Anthropic披露Claude测试逃逸,越权访问三家真实系统(14 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →