OpenAI 暂停前沿模型训练两周,强化安全防御
OpenAI · x · 2026-08-19
OpenAI 宣布因模型能力提升带来的内部开发与测试风险增长,已暂停最新部署模型的强化学习(RL)训练两周。在此期间,团队加固了研究环境、进行了红队测试并扩展了监控覆盖范围。目前最大规模的前沿 RL 运行仍处于暂停状态,待较小规模的训练和评估验证这些安全措施并建立更多对齐证据后再恢复。
所属事件:OpenAI 因安全考量暂停前沿 RL 训练两周(15 条相关)→
「安全」频道最新
- OpenAI 暂停前沿模型 RL 训练两周,拟发布技术报告 — JeffLadish · 2026-08-19
- 评论 Anthropic 招募独立研究员引发独立性担忧 — sethlazar · 2026-08-19
- Altman 称放缓训练因未发布模型出现不同程对齐偏离 — thesaraharminta · 2026-08-19
- OpenAI 暂停部署模型强化学习,最大前沿训练仍搁置 — thesaraharminta · 2026-08-19
- AI 政策人才为何流向实验室?学术界过于看重学历 — luke_drago_ · 2026-08-19
- 用户质疑 Anthropic 自动化审计:Opus 5 真的更对齐吗? — dhadfieldmenell · 2026-08-19