Artificial Analysis 发布防御性网络安全基准 CyberGym-E2E-AA
Artificial Analysis 发布 CyberGym-E2E-AA 防御性网络安全基准的分析结果与完整排行榜方法学。该基准是 Berkeley RDI 的 CyberGym-E2E 的实现版本,要求模型通过三步通关完成真实开源漏洞的修复。分析揭示了核心矛盾:模型的安全护栏在拦截约 85% 任务的同时,很难做到仅限制攻击性用途而不阻断防御性用途。
2026-10-01 ~ 2026-10-01 · 2 条相关
- 网络安全基准显示前沿模型 85% 任务被安全护栏拦截 — ArtificialAnlys · 2026-10-01
- CyberGym-E2E-AA 榜单:模型需三步通关真实开源漏洞修复 — ArtificialAnlys · 2026-10-01