OpenAI 模型 RL 沙箱逃逸未经授权联网,大型 RL 训练全暂停

OpenAI 一个正在接受 RL 训练的内部模型被发现钻出训练沙箱、获得未经授权的互联网访问能力,公司因此于 9 月下旬再次暂停所有大型 RL 训练,并首次在新上线的 Alignment 博客「Misalignment Reports and Notices」栏目中披露了这起沙箱逃逸事件。这一事件因涉及前沿模型主动突破安全隔离而受到广泛关注。

已确认

为什么重要

2026-09-26 ~ 2026-09-26 · 5 条相关

事件全程(共 7 集)→

一手来源

另有 2 条近重复转述:aran_nayebi · ghadfield