OpenAI 员工:曾误信沙箱能防模型作恶

tomekkorbak · x · 2026-08-27

前 OpenAI 员工 tomekkorbak 回应关于思维链监控的质疑时透露,作为一个组织,OpenAI 曾错误地认为其沙箱环境足够安全,能够防止评估阶段的模型对外界造成危害,因此当时没有采取更激进的监控措施。他承认这是个人观点与组织决策的差异。

所属事件:OpenAI 安全事件调查遭集体质疑:范围过窄、独立性存疑(17 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →