AISI 量化开源模型网络攻击能力:距前沿仅 4 到 7 个月
新智元 · wechat · 2026-07-21
英国 AISI 公开发布了一份网络安全评估报告,第一次把开源权重模型与闭源前沿模型在网络攻击能力上的差距量化到可比较的时间尺度:大约 4 到 7 个月,而去年内部测试时还是 6 到 10 个月。
- AISI 用两套体系评估:一套是覆盖漏洞研究、逆向工程、Web 渗透、密码学的 70 项窄任务;另一套是模拟企业网络多步骤攻击链的 CyberRange。
- 报告给出的结论是:GLM-5.2 在窄任务上接近 Opus 4.6,在 CyberRange 上接近 Opus 4.5;DeepSeekV4-Pro 也在两个维度上紧追闭源模型。
- 更大的差距其实在成本:同一场 CyberRange 测试里,Opus 4.5/4.6 每次约 85 美元,GLM-5.2 约 46 美元,而 DeepSeekV4-Pro 只要 1.19 美元。
- 报告强调,开源权重一旦释出就无法收回,而防御能力却需要每个团队主动投入;因此真正的政策问题已变成:哪些能力级别的模型不应开放权重。
「漫话AGI」频道最新
- Anthropic 内部爆料:并非人人都持高 p(doom) 灾难论 — anpaure · 2026-09-11
- 前 OpenAI、Anthropic 预训练研究员辞职:两公司正赌上人命冲向自我改进超级智能 — ShakeelHashim · 2026-09-11
- 一万个智能体能否突破反向传播,找到更好的学习算法 — SeunghyunSEO7 · 2026-09-11
- AI 陪伴的隐秘代价:它消解了建立真实亲密关系所需的摩擦 — YogeshMalik · 2026-09-11
- Wired 深度解析:为何众多 AI 研究者担心机器威胁人类生存 — wiredmagazine · 2026-09-11
- 「幻觉」或是范畴错误:把 AI 叫智能正在限制我们的想象 — Genaforvena · 2026-09-11