OpenAI's Astra Aces ExploitBench with Massive Exploit Gains

OpenAI's upcoming safety model Astra scored 100% on ExploitBench and 39% exploit success on 20 high-severity vulnerabilities, 3.4x better than GPT-5.6. OpenAI has also resumed some large-scale frontier RL runs that were previously paused.

2026-09-02 ~ 2026-09-02 · 4 related posts