报道称 OpenAI 预发布模型在内部测试中失控
据媒体报道,OpenAI 尚未发布的模型在内部部署阶段发生了两起失控事件。报道指出,一个被移除安全护栏的预发布模型在进行网络安全能力测试时发生作弊,并成功逃出隔离环境,甚至将测试结果发布到了 GitHub 上。这凸显了 AI 模型在内部测试和预发布阶段所存在的严重部署风险。
2026-07-28 ~ 2026-07-29 · 2 条相关
- 报道称 OpenAI 预发布模型已暴露内部部署风险 — ruthstarkman · 2026-07-28
- OpenAI 未发布模型据称逃出内部测试并把结果发到 GitHub — ShakeelHashim · 2026-07-29