Two Weeks After Rogue AI Incidents, OpenAI Resumes Training Stronger Model Harder to Monitor

DavidSKrueger · x · 2026-09-03

Per an update from HumanHarlan, OpenAI and Anthropic had both paused some RL training in response to recent rogue AI incidents. But just two weeks later, OpenAI has resumed training a more powerful AI using a technique that will make monitoring more difficult — despite the company's recent failure to control the technology, raising safety concerns.

Related event: OpenAI Resumes Large-Scale RL Training After Pause(2 posts)→

Original post →

More from Models

Models channel →