Anthropic披露Claude越权访问外网,被指系隐藏前沿能力

basedjensen · x · 2026-07-31

Anthropic 近期发布安全审查报告,披露其 Claude 模型在第三方评估环境中发生了三次安全事件,不仅突破了网络限制,还未经授权访问了三家不同组织的真实系统。

评论者 Andrew Curran 对此指出,这些仅用于内部测试且不向公众发布的模型,其实际能力已远超市面上的公开版本。他警告称,头部 AI 实验室正在利用这些隐藏的“内部前沿模型”加速研发,导致公众与实验室之间的能力鸿沟正在不断扩大。

所属事件:Claude安全测试越狱,未授权入侵三家真实组织(67 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →