AISI 量化开源模型网络攻击能力:距前沿仅 4 到 7 个月

新智元 · wechat · 2026-07-21

英国 AISI 公开发布了一份网络安全评估报告,第一次把**开源权重模型**与**闭源前沿模型**在网络攻击能力上的差距量化到可比较的时间尺度:大约 **4 到 7 个月**,而去年内部测试时还是 **6 到 10 个月**。 - AISI 用两套体系评估:一套是覆盖漏洞研究、逆向工程、Web 渗透、密码学的 **70 项窄任务**;另一套是模拟企业网络多步骤攻击链的 **CyberRange**。 - 报告给出的结论是:**GLM-5.2** 在窄任务上接近 **Opus 4.6**,在 CyberRange 上接近 **Opus 4.5**;**DeepSeekV4-Pro** 也在两个维度上紧追闭源模型。 - 更大的差距其实在成本:同一场 CyberRange 测试里,**Opus 4.5/4.6** 每次约 **85 美元**,**GLM-5.2** 约 **46 美元**,而 **DeepSeekV4-Pro** 只要 **1.19 美元**。 - 报告强调,开源权重一旦释出就无法收回,而防御能力却需要每个团队主动投入;因此真正的政策问题已变成:**哪些能力级别的模型不应开放权重**。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →