安全评测已饱和:业界呼吁告别 CyberGym Level 1

andreamichi · x · 2026-07-30

安全研究员指出,知名网络安全基准测试 CyberGym Level 1 已经失去有效的区分度,不应再作为衡量模型安全能力的代表性基准。

自 2025 年 6 月推出以来,该测试曾大幅提升了行业评估标准。最初顶尖的智能体模型组合成功率仅约 20%,Claude 3.5 Sonnet 也只有 17.9%。但到了 2026 年 4 月,Mythos 惊人地拿下了 83.1% 的分数,如今多家公司的成绩都已突破 90%。

随着榜单成绩严重挤压,该基准已经饱和。包括 Anthropic 和 Depth First Labs 在内的专业机构,均已转向更具挑战性的测试维度。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →