长程网络安全能力差距缩小
rohanpaul_ai · x · 2026-07-18
这条帖转述了一组关于长时程网络安全能力的评测结果:在 AISI 的 32 步 “The Last Ones” cyber range 上,最新开放权重模型与闭源前沿模型之间的差距,已经从 2025 年大部分时间里的约 6–10 个月,缩小到约 4–7 个月。
图中同时给出两类结果:在长时程 cyber range 上,GLM-5.2 的表现接近约 4 个月前发布的闭源模型;而在 AISI 的 32 步任务里,GPT-5.6 Sol 在 100M token 预算下 10 次里有 7 次完成全部 32 步。作者强调:随着推理 token 增加,模型能力会继续上升,也就是说,攻击/防御能力可以通过增加运行时算力而显著增强,而不一定需要重新训练。
所属事件:AISI称开源模型缩小网络安全差距(6 条相关)→
「模型」频道最新
- Grok 4.5 在 Cursor 里免费开放使用 — mark_k · 2026-07-21
- GPT 在数学题上常收敛到相似的近似思路 — yacineMTB · 2026-07-21
- Eno Reyes:模型蒸馏基本已经不可阻挡 — LangChain · 2026-07-21
- Sakana 用多扩散模型协作提升编程和数学表现 — SakanaAILabs · 2026-07-21
- OpenAI 黑客松项目卡住了:Codex 语音吃力,Claude 反而先诊断出问题 — ColleenMBrady · 2026-07-21
- Kimi K3 精准落在中国两年 AI 能力趋势线上 — peterwildeford · 2026-07-21