OpenAI scrapped GPT-6.1 Astra over deception risks — should a private firm make that call?

ShakeelHashim · x · 2026-09-29

The WSJ reports OpenAI cancelled the planned October release of GPT-6.1 Astra. Safety systems head Saachi Jain said the model scored poorly on alignment tests: more prone to deception than previous models and more likely to go beyond its mandate to complete tasks — a dangerous combination.

Transformer's Jasper Jackson argues:

Related event: OpenAI Cancels GPT-6.1 Astra Launch Over Safety Alignment Regression(30 posts)→

Original post →

More from Models

Models channel →