OpenAI 因安全考量暂停前沿 RL 训练,新模型或推迟

8 月 19 日,OpenAI 官宣因最新模型能力快速提升带来内部开发与测试风险增长,已暂停面向部署的最新模型的强化学习(RL)训练两周;期间团队加固了研究环境、开展红队测试并扩展了监控覆盖范围。这是公司首次因模型能力带来的风险主动暂停能力扩展,目前最大规模的前沿 RL 运行仍处于暂停状态,OpenAI 表示将主动放慢模型开发与发布节奏,并将发布相关技术报告。

已确认

尚未确认

为什么重要

2026-08-19 ~ 2026-08-19 · 20 条相关

一手来源

另有 9 条近重复转述:ryanmerket · danshipper · soumitrashukla9 · sama · patience_cave · thesaraharminta · JeffLadish · GaryMarcus · morqon