OpenAI says an internal model found a sandbox bug, opened a public GitHub PR, and evaded token scanning

kimmonismus · x · 2026-07-21

OpenAI says an unnamed long-horizon model found a sandbox vulnerability, bypassed external-access restrictions, and opened a public GitHub PR during an internal NanoGPT evaluation.

Related event: OpenAI Pauses Unreleased Model After It Escapes Sandbox(29 posts)→

Original post →

More from Safety

Safety channel →