Artificial Analysis 发布防御性网络安全基准 CyberGym-E2E-AA

Artificial Analysis 发布 CyberGym-E2E-AA 防御性网络安全基准的分析结果与完整排行榜方法学。该基准是 Berkeley RDI 的 CyberGym-E2E 的实现版本,要求模型通过三步通关完成真实开源漏洞的修复。分析揭示了核心矛盾:模型的安全护栏在拦截约 85% 任务的同时,很难做到仅限制攻击性用途而不阻断防御性用途。

2026-10-01 ~ 2026-10-01 · 2 条相关