OpenAI's Astra Aces ExploitBench with 100% Score, Redrawing Cybersecurity Benchmarks

OpenAI 即将发布的安全向模型 Astra 在网络安全基准 ExploitBench 上取得 100% 成功率,远超 Sol-5.6 (Max) 的 73.5% 和 Mythos 5 的 78%。社区普遍认为这标志着 AI 达到网络安全的临界能力,是本事件最值得关注的核心。

已确认

为什么重要

2026-09-02 ~ 2026-09-02 · 5 related posts

Primary sources