Astra 刷爆 ExploitBench 百分百胜率,达网安临界能力

infoxiao · x · 2026-09-02

Astra 模型在 ExploitBench 测试中取得 100% 成功率。为测试真实性,团队用模型知识截止日期后的新漏洞构建了内部刷新基准,结果显示 Astra 仍显著强于 GPT-5.6 Sol 且消耗更少 token。结合其他证据,团队认为 Astra 已达到“网安临界”能力阈值。

所属事件:OpenAI Astra 在漏洞利用基准大幅超越 GPT-5.6(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →