OpenAI opens models to third-party safety evals during training, covering robustness and misalignment

emmanuelvivier · x · 2026-09-23

OpenAI is opening its models to third-party safety evaluations starting from the training stage, with coverage including robustness and misalignment.

Related event: OpenAI Opens Training-Stage Access to Third-Party Safety Evaluators(4 posts)→

Original post →

More from Safety

Safety channel →