AISI 量化开源模型网络攻击能力:距前沿仅 4 到 7 个月
新智元 · wechat · 2026-07-21
英国 AISI 公开发布了一份网络安全评估报告,第一次把**开源权重模型**与**闭源前沿模型**在网络攻击能力上的差距量化到可比较的时间尺度:大约 **4 到 7 个月**,而去年内部测试时还是 **6 到 10 个月**。 - AISI 用两套体系评估:一套是覆盖漏洞研究、逆向工程、Web 渗透、密码学的 **70 项窄任务**;另一套是模拟企业网络多步骤攻击链的 **CyberRange**。 - 报告给出的结论是:**GLM-5.2** 在窄任务上接近 **Opus 4.6**,在 CyberRange 上接近 **Opus 4.5**;**DeepSeekV4-Pro** 也在两个维度上紧追闭源模型。 - 更大的差距其实在成本:同一场 CyberRange 测试里,**Opus 4.5/4.6** 每次约 **85 美元**,**GLM-5.2** 约 **46 美元**,而 **DeepSeekV4-Pro** 只要 **1.19 美元**。 - 报告强调,开源权重一旦释出就无法收回,而防御能力却需要每个团队主动投入;因此真正的政策问题已变成:**哪些能力级别的模型不应开放权重**。
「漫话AGI」频道最新
- 人们争论荷马时,往往默认自己读的是同一版史诗 — RachelVT42 · 2026-07-21
- 帖子称机器将在 12 到 18 个月内取代你的工作 — rand_longevity · 2026-07-21
- Reddit 讨论:蒸馏并不能单独解释中国模型崛起 — pier4r · 2026-07-21
- 新论文称 scaffold 只解释了 1.5% 的智能体性能差异 — gerardsans · 2026-07-21
- Fink 说中国领跑 AI 能源赛,称在建 100GW 核电 — rohanpaul_ai · 2026-07-21
- Jamie Dimon:压垮智能的不是 AI,而是官僚体系 — r0ck3t23 · 2026-07-21