失控事件仅两周后,OpenAI 恢复训练更强 AI 且监控难度更高

DavidSKrueger · x · 2026-09-03

Harlan 更新爆料:OpenAI 与 Anthropic 曾因近期的「失控 AI 事件」暂停部分 RL(强化学习)训练。但仅仅两周后,OpenAI 就恢复训练更强的 AI,且所采用的技术会让监督监控变得更加困难——而该公司尚未真正解决对既有技术的控制问题。帖子隐含的批评是:在安全能力未跟上之前重启更强模型的训练,风险值得关注。

所属事件:OpenAI 被曝已恢复大规模强化学习训练(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →