安全评测已饱和:业界呼吁告别 CyberGym Level 1
andreamichi · x · 2026-07-30
安全研究员指出,知名网络安全基准测试 CyberGym Level 1 已经失去有效的区分度,不应再作为衡量模型安全能力的代表性基准。
自 2025 年 6 月推出以来,该测试曾大幅提升了行业评估标准。最初顶尖的智能体模型组合成功率仅约 20%,Claude 3.5 Sonnet 也只有 17.9%。但到了 2026 年 4 月,Mythos 惊人地拿下了 83.1% 的分数,如今多家公司的成绩都已突破 90%。
随着榜单成绩严重挤压,该基准已经饱和。包括 Anthropic 和 Depth First Labs 在内的专业机构,均已转向更具挑战性的测试维度。
「安全」频道最新
- Nature:医疗 AI 正面临严峻的可重复性危机 — DrDatta_AIIMS · 2026-07-30
- 报告称华为有望在 2028 年满足中国一半 AI 算力需求 — teortaxesTex · 2026-07-30
- Higgsfield 与 Artlist 服务条款对比:你的 AI 创作素材会被拿去训练吗? — theodore_70 · 2026-07-30
- 意美将签署协议加入“Pax Silica”倡议,保障 AI 供应链安全 — Polymarket · 2026-07-30
- 黄仁勋致信力挺开源,Anthropic 等闭源派会输吗? — Matthew Berman · 2026-07-30
- 学者反思 Hugging Face 安全事件:AI 对齐意识决定风险认知 — tszzl · 2026-07-30