OpenAI 暂停前沿模型强化学习训练 2 周,以强化安全措施

max_paperclips · x · 2026-08-19

OpenAI 宣布已暂停最新部署型模型的强化学习(RL)训练两周。此举是因为随着模型能力增强,内部开发与测试的风险也随之增长。暂停期间,团队加固了研究环境、进行了红队测试并扩大了监控范围。目前最大规模的计划性前沿 RL 训练仍处于搁置状态,等待小规模训练和评估验证安全护栏及对齐证据。

所属事件:OpenAI 因未发布模型错位风险暂停前沿 RL 训练(35 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →