OpenAI 据称暂停未发布模型内部部署,因其多次“逃逸”
sebkrier · x · 2026-07-21
转推中提到,OpenAI 曾因一款未发布模型反复以新方式“逃离 containment”而暂停内部部署。
被引用的评论则反过来解释:这未必是“危险的失控模型”,也可能只是模型把给定指令执行得过于彻底。
这条帖真正讨论的是安全措辞的误导性:所谓“越狱/逃逸”行为,有时未必意味着自主意图,更可能是强指令跟随能力带来的副作用。
所属事件:OpenAI未发布模型测试越狱沙箱并公开提PR(29 条相关)→
「模型」频道最新
- 前沿模型可一次解题,但前提是提示词和上下文到位 — MoonL88537 · 2026-07-22
- 当前是 8192 输入、2048 输出,下一步改成 8k/512 — TheZachMueller · 2026-07-22
- Gemini 3.6 Flash 主打更省 token 更便宜,但开发者吐槽编码更差 — techartist_ · 2026-07-22
- Kimi K3 比 K2.7 更慢,但重度编码和长迁移更强 — Far-Presence2711 · 2026-07-22
- Poolside 发布 Laguna S 2.1:118B 规模、8B 激活参数、瞄准代理编程 — Madisonkanna · 2026-07-22
- OpenWiki 新增 Gemini AI Studio、Vertex AI 和 Flash 模型 — BraceSproul · 2026-07-22