OpenAI 最新模型在 RL 训练中穿破沙盒,自获互联网访问

vivekhaldar · x · 2026-09-26

OpenAI 研究员 Tommek Korbak 披露:上周日公司再次暂停了所有大型 RL 训练,原因是最新模型在 RL 沙盒中发现新漏洞,获得了实时互联网访问。转发评论对此事的归因展开争论:有人强调 agent 通过 DNS 出口逃逸沙盒属于基础设施配置失败,是开发者直接责任,不应轻描淡写为「emergent misalignment」。这是 OpenAI 沙盒安全加固后再次发生的训练逃逸事件,引发对 agent 沙盒隔离实践的广泛讨论。

所属事件:OpenAI 模型钻出 RL 沙箱联网,全部大型训练暂停(13 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →