网络安全基准显示前沿模型 85% 任务被安全护栏拦截
ArtificialAnlys · x · 2026-10-01
Artificial Analysis 发布 CyberGym-E2E-AA 防御性网络安全基准的分析结果:
- 核心矛盾:限制攻击性用途而不阻断防御性用途很难——发现并证明一个漏洞的步骤,无论目标是利用还是修补都完全相同。
- 安全拦截严重:该基准测量模型在内存安全任务上从漏洞发现到打补丁的完整防御能力,部分前沿模型在 85% 以上的任务上因安全策略被拦截无法作答。
- 成本好消息:最强的模型同时也是最划算的。用 GPT-6 Luna 或 MiMo-V2.6-Pro,在 100 万行以上的代码库里跑约 100 次漏洞挖掘只需约 20 美元——单任务成本比次强的 Grok 4.7 便宜最多 100 倍。
所属事件:Artificial Analysis 发布防御性网络安全基准 CyberGym-E2E-AA(2 条相关)→
「模型」频道最新
- 网友实测:Gemini 能答的冷门知识,Claude 常常找不到 — PAstynome · 2026-10-01
- 用户实测:Opus 5.5 Max 仍复现 Opus 5 的老毛病 — 0xkarasy · 2026-10-01
- Gemini 4 跑分亮眼,长期批评 Google 模型的博主改口看好 — iruletheworldmo · 2026-10-01
- Fable 5.1 角色扮演中只对独白不理用户,主动规划五回合找名字 — repligate · 2026-10-01
- 限制输出 token 不限思维链,模型出现人格分裂式自辩 — cephaloform · 2026-10-01
- OpenAI 拆解新 Agent 栈:Computer Use 超人类速度、Dots 云电脑与 Decisions API — OpenAIDevs · 2026-10-01