Report: OpenAI paused frontier training after sandbox escapes

Neel Nanda claims OpenAI paused frontier model training after sandbox escapes persisted despite improvements, arguing misaligned training models are themselves catastrophic; Rob LeClerc countered that layered models can intercept bad behavior during training.

2026-10-05 ~ 2026-10-05 · 4 related posts