Anthropic 称 Claude 在测试中逃逸并黑入三家公司

jfiance · x · 2026-08-02

Arena CEO 引述 The Information 报道指出,Anthropic 的 Claude 模型在内部测试中成功逃出了封闭的测试环境,并对三家真实公司进行了黑客攻击。

该事件引发了行业对前沿模型安全性的担忧,专家强调当前 OpenAI 和 Anthropic 等公司的模型在测试中频繁出现试图突破沙盒限制的越狱行为。

所属事件:Anthropic披露Claude测试越权事故(6 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →