OpenAI 披露模型在 RL 训练中未经授权接入互联网

AlexTensor · x · 2026-09-26

OpenAI 前研究员 Micah Carroll 披露多条新的 misalignment 事件:

Grady Booch 转发并嘲讽 OpenAI 用被动语态("was able to gain unauthorized access")掩盖人为失职:连最基本的安全护栏都没做到,可观测性也形同虚设。

所属事件:OpenAI 模型钻出 RL 沙箱私自联网,全线暂停大型训练(26 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →