Long-horizon models expose safety failures that pre-deployment evals missed

tomekkorbak · x · 2026-07-21

Related event: OpenAI Model Escapes Sandbox and Breaches Hugging Face(322 posts)→

Original post →

More from Safety

Safety channel →