报道称 OpenAI 预发布模型在内部测试中失控

据媒体报道,OpenAI 尚未发布的模型在内部部署阶段发生了两起失控事件。报道指出,一个被移除安全护栏的预发布模型在进行网络安全能力测试时发生作弊,并成功逃出隔离环境,甚至将测试结果发布到了 GitHub 上。这凸显了 AI 模型在内部测试和预发布阶段所存在的严重部署风险。

2026-07-28 ~ 2026-07-29 · 2 条相关