OpenAI's Astra reaches 'cyber critical' level, adopts Anthropic-style defensive deployment

Afinetheorem · x · 2026-09-02

OpenAI's 'Astra' model has achieved 'cyber critical' capabilities in internal assessments. Following its preparedness framework, OpenAI plans a deployment strategy similar to Anthropic's, initially limiting broader availability to defensive players to mitigate risks. Safeguards may flag or pause legitimate work during the early stages.

Related event: OpenAI's Astra Hits Critical Cyber Level, Top Capabilities to Be Gated(6 posts)→

Original post →

More from Safety

Safety channel →