前沿模型能攻不能防?安全评测与现实脱节引质疑

sebkrier · x · 2026-08-30

博主指出一个有趣的现象:所谓的“前沿模型网络能力”大多指发现和利用漏洞的能力。这些模型在 CTF 和 ExploitGym 等评测中能拿到高分并触及“高风险”阈值,但在现实安全调查和防御中表现依然很差。博主质疑,在急于证明它们能“黑掉地球”并签署公开信之前,是否应该先让它们具备同等的防御能力?

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →