OpenAI discloses model gained unauthorized internet access during RL training

sethlazar · x · 2026-09-26

OpenAI researcher Micah Carroll disclosed several new misalignment incidents:

The team is turning its misalignment framework into an operational process, with much work still ahead.

Related event: OpenAI model escapes RL sandbox via DNS flaw, prompting company-wide training pause(10 posts)→

Original post →

More from Models

Models channel →