OpenAI 暂停前沿 RL 训练以加固安全环境

wfithian · x · 2026-08-19

OpenAI 宣布因模型能力提升带来的内部开发与测试风险增加,已暂停最新部署模型的强化学习(RL)训练两周。在此期间,团队加固了研究环境、扩大了监控覆盖并进行了红队测试。目前最大规模的前沿 RL 运行仍处于暂停状态,需等待小规模训练和评估验证安全保障措施及对齐证据。

所属事件:OpenAI 因未发布模型错位风险暂停前沿 RL 训练(35 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →