OpenAI 暂停前沿模型 RL 训练两周,拟发布技术报告

JeffLadish · x · 2026-08-19

OpenAI 在关于 Hugging Face 事件的博客文章中表示,随着模型能力增强,内部开发与测试的风险随之增长。公司已暂停针对部署的最新模型的强化学习(RL)训练两周,以加固和红队测试研究环境并扩大监控覆盖范围。其最大的前沿 RL 运行仍处于暂停状态,直到较小规模的训练和评估验证了这些安全保障措施并建立更多对齐证据。OpenAI 承诺将在未来几周发布关于此次事件经验教训的技术报告。

所属事件:OpenAI 因安全考量暂停前沿 RL 训练,新模型或推迟(20 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →