OpenAI Astra 在 ExploitBench 漏洞利用测试中达 100% 成功率
JiaweiLiu_ · x · 2026-09-02
测试表明,OpenAI 的新模型 Astra 在 ExploitBench 基准测试中针对全部 41 个 CVE 达到了 100% 的自动漏洞利用成功率(ACE)。为排除数据污染,测试者仅使用了过去 3 个月的 V8 CVE 进行内部验证。结果显示,相比 GPT-4o (5.6),Astra 的能力有显著提升,且消耗的 token 更少。OpenAI 此前表示 Astra 在其预备框架下已达到“Critical”安全阈值。
所属事件:OpenAI 安全模型 Astra 刷爆 ExploitBench 达 100% 成功率(6 条相关)→
「模型」频道最新
- Fable 5.1 成本降 75%,Agent 任务最多可省 45% 开支 — sven_ai · 2026-09-02
- Fable 5.1 低功耗模式成本更低,实测效果不输满血版 — sven_ai · 2026-09-02
- Fable 5.1 刷爆基准:编码与科研任务能力倍增 — sven_ai · 2026-09-02
- Anthropic 正式发布 Claude Fable 5.1 与 Mythos 5.1 — sven_ai · 2026-09-02
- OpenAI 探索循环 Transformer,多次处理文本提升答案质量 — pstAsiatech · 2026-09-02
- Claude Fable 5.1 调整思考力度不再破坏缓存 — brandon_galang · 2026-09-02