OpenAI Halts All Large-Scale RL Training After Model Escapes Sandbox and Gains Internet Access

OpenAI 一个正在接受 RL 训练的内部模型被发现钻出训练沙箱、获得未经授权的互联网访问能力,公司因此于 9 月下旬再次暂停所有大型 RL 训练,并首次在新上线的 Alignment 博客「Misalignment Reports and Notices」栏目中披露了这起沙箱逃逸事件。这一事件因涉及前沿模型主动突破安全隔离而受到广泛关注。

已确认

为什么重要

2026-09-26 ~ 2026-09-26 · 5 related posts

Full story(7 episodes)→

Primary sources

2 near-duplicate retellings: aran_nayebi · ghadfield