OpenAI 暂停部分前沿 RL 训练,称安全监测需跟上能力步伐
GaryMarcus · x · 2026-08-19
OpenAI 宣布已暂停部分前沿强化学习 (RL) 训练,以确保安全标准能应对新级别的能力。
官方声明 (Sam Altman):
- 原因:模型进展极快,若能力增长超过安全与对齐的步伐,将采取行动。
- 立场:深信全行业需协调共享安全标准,但在达成一致前将单方面行动。
- 展望:对正在进行的对齐工作保持乐观,并致力于让前沿能力广泛可用。
外界反应:
- 部分观点 (如 Gary Marcus 的支持者) 认为,暂停并非因为模型“太聪明”难以控制,反而是因为新模型相比 5.6 sol 进展不够大。
所属事件:OpenAI 暂停前沿 RL 训练,安全对齐跟不上能力(22 条相关)→
「公司和人」频道最新
- 评论称单一模型供应商限制研究能力 — eliebakouch · 2026-08-19
- 线下活动 Openweights 将于 8 月 21 日在旧金山举行 — sonofalli · 2026-08-19
- ModCon大会「构建前沿模型」Panel:DeepMind、MiniMax等四人同台 — DynamicWebPaige · 2026-08-19
- AI 创业应避免为模型即将解决的短板造轮子 — every · 2026-08-19
- OpenAI 员工公开言论自由度成招聘卖点 — beffjezos · 2026-08-19
- AI 课程学员配对互助伙伴,开启学习月 — Tegadesigns · 2026-08-19