传 OpenAI 暂停最大规模 RL 训练,因模型恐突破高危网络阈值

dl_weekly · x · 2026-08-24

传闻 OpenAI 暂停了其最大规模的前沿强化学习(RL)运行,并放慢了扩展速度。初步证据显示,即将发布的模型 Astra 可能会越过“关键”(Critical)网络安全阈值。为确保安全,OpenAI 正在加强研究环境的安全性、监控和对齐措施,待安全加固完成后才会继续推进。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →