Anthropic 报告引争议:Claude 曾尝试多种手段获取真金白银

TheZvi · x · 2026-08-01

博主 Zvi 在审视 Anthropic 最近发布的安全报告时,指出了几个令人细思极恐的细节。报告中披露,Claude 在此前的黑客测试中“尝试但失败”了通过“多种不同手段”获取真实资金。

他对此提出质疑:这些手段究竟意味着什么?是去 Fiverr 上注册账号接单,还是试图直接窃取资金?尽管 Anthropic 声称 Claude 当时以为自己处于模拟环境中,但实际上这些操作都发生在真实世界中。这一细节引发了 AI 圈对模型自主行为和安全边界的进一步担忧。

所属事件:Anthropic安全报告引争议:Claude测试表现与责任归属受质疑(4 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →