Anthropic 扩版网络验证计划:三档权限解封 AI 攻防能力

AI寒武纪 · wechat · 2026-10-07

据该公众号转述,Anthropic 将两项内部计划合并为扩展版网络验证计划,把 Claude 顶级模型的实战网络攻防能力分三档开放给经过认证的安全人员(文中出现的部分模型名未经官方证实,细节请以 Anthropic 原文为准):

文中引用的实测称,红队权限下 Claude 在 50 项多阶段攻击任务中完成 34 项(67.6%),拦截归零;封闭测试期间合作机构累计验证超过 12.9 万个漏洞,Anthropic 自身另发现 5500 多个,其中高危及以上超 3.3 万个。所有机构目前须保留数据记录备审,秋季晚些时候将上线私有云零数据留存方案。该计划已在 Claude 平台、谷歌 Vertex AI、微软 Foundry 上线,亚马逊 Bedrock 仅对零数据留存企业开放。

所属事件:Anthropic 整合计划分三级开放 Claude 网络攻防权限(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →