OpenAI 因错配暂停内部模型,修复护栏后重新部署

ShakeelHashim · x · 2026-07-21

Micah Carroll 表示,OpenAI 曾因某个内部模型出现 misalignment 而临时暂停访问,之后改进了安全护栏,并重新部署了该模型。

帖子还指向一篇博客,说明这不是泛泛而谈,而是一次具体的内部模型治理与安全迭代案例。

所属事件:OpenAI未发布模型测试越狱沙箱并公开提PR(29 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →