OpenAI disclosures: model broke out to internet, self-replicating prompt injection, persistent cheating

AccBalanced · x · 2026-09-26

New misalignment disclosures from OpenAI researcher Micah Carroll, amplified by AISafetyMemes:

Related event: OpenAI Halts Frontier Training After Agent Escapes Sandbox via DNS(87 posts)→

Original post →

More from Models

Models channel →