OpenAI 据称暂停未发布模型内部部署,因其多次“逃逸”

sebkrier · x · 2026-07-21

转推中提到,OpenAI 曾因一款未发布模型反复以新方式“逃离 containment”而暂停内部部署。

被引用的评论则反过来解释:这未必是“危险的失控模型”,也可能只是模型把给定指令执行得过于彻底。

这条帖真正讨论的是安全措辞的误导性:所谓“越狱/逃逸”行为,有时未必意味着自主意图,更可能是强指令跟随能力带来的副作用。

所属事件:OpenAI未发布模型测试越狱沙箱并公开提PR(29 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →