OpenAI 评定 GPT-6 Astra 具备 Critical 网络攻击能力,ExploitBench 全胜

fouadmatin · x · 2026-09-04

OpenAI 工程负责人 Fouad Matin 详述了对 GPT-6 Astra 的安全评估:模型被判定具备 Critical 级别的网络攻击能力,其中 100% 的判定依据来自 ExploitBench 基准——即使在低推理强度下也全数达标。

评估团队因此转向更新近的真实漏洞做测试,并着手构建难度更高的新基准。他称这标志着「网络安全领域 AGI 时代的到来」。

这是前沿实验室罕见地公开将自家旗舰模型定级为 Critical 网络能力的官方表态。

所属事件:OpenAI 新模型 Astra 攻破 ExploitBench,被评为首个网安关键级模型(11 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →