OpenAI 暂停前沿模型训练两周以强化安全

rohanpaul_ai · x · 2026-08-19

OpenAI 宣布暂停其最新前沿模型的原定强化学习(RL)训练两周。此举旨在加固研究环境、扩大红队测试(red-teaming)及监控覆盖范围。目前,最大规模的 frontier RL 训练仍处于暂停状态,直到小规模训练和评估验证了这些安全护栏,并确立更多对齐证据。

所属事件:OpenAI 首次因安全对齐风险暂停前沿 RL 训练(29 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →