Anthropic 扩版网络验证计划:三档权限解封 AI 攻防能力
AI寒武纪 · wechat · 2026-10-07
据该公众号转述,Anthropic 将两项内部计划合并为扩展版网络验证计划,把 Claude 顶级模型的实战网络攻防能力分三档开放给经过认证的安全人员(文中出现的部分模型名未经官方证实,细节请以 Anthropic 原文为准):
- 防御权限:面向蓝队,含安全运营响应、恶意软件逆向、漏洞复现验证;企业、高校、政府、关键基础设施运营方、开源维护者及独立研究员可申请,审核数天。
- 红队权限:增加授权渗透测试与红队对抗,仅对机构开放;检测到勒索软件部署、破坏物理系统等高危动作仍会实时拦截,审核需数周。
- 特种权限:留给极少数机构测试电网、航空、电信等关键系统,需与美国政府联合背景审查。
文中引用的实测称,红队权限下 Claude 在 50 项多阶段攻击任务中完成 34 项(67.6%),拦截归零;封闭测试期间合作机构累计验证超过 12.9 万个漏洞,Anthropic 自身另发现 5500 多个,其中高危及以上超 3.3 万个。所有机构目前须保留数据记录备审,秋季晚些时候将上线私有云零数据留存方案。该计划已在 Claude 平台、谷歌 Vertex AI、微软 Foundry 上线,亚马逊 Bedrock 仅对零数据留存企业开放。
所属事件:Anthropic 整合计划分三级开放 Claude 网络攻防权限(2 条相关)→
「模型」频道最新
- 本地模型写小说横评:Gemma 31B 微调版完胜,Qwen 基座太差 — falconandeagle · 2026-10-09
- 开发者称 90% 编码工作已交给 Grok bot 处理 — jonathan_wilke · 2026-10-09
- State of AI 2026 发布:预测 AGI 2027 年到来,九大趋势前瞻 — FinanceYF5 · 2026-10-09
- Anthropic 编码领先但未全面碾压 OpenAI,Astra 6.1 将至 — haider1 · 2026-10-09
- ChatGPT 500 美元档实测:周上限约 90M Sol + 25M Luna tokens — airesearch12 · 2026-10-09
- 博主吐槽:让 Opus 仿我声音做视频,比写人味文字容易多了 — tobowers · 2026-10-09