OpenAI 暂停前沿模型训练两周以强化安全
rohanpaul_ai · x · 2026-08-19
OpenAI 宣布暂停其最新前沿模型的原定强化学习(RL)训练两周。此举旨在加固研究环境、扩大红队测试(red-teaming)及监控覆盖范围。目前,最大规模的 frontier RL 训练仍处于暂停状态,直到小规模训练和评估验证了这些安全护栏,并确立更多对齐证据。
所属事件:OpenAI 首次因安全对齐风险暂停前沿 RL 训练(29 条相关)→
「安全」频道最新
- 美数据中心反智潮:公众无视AI带来的医疗与国防红利 — Afinetheorem · 2026-08-19
- 质疑以安全为名收集用户数据训练模型 — beffjezos · 2026-08-19
- 研究发现 AI 智能体可互相感染自我复制的“思维病毒” — Polymarket · 2026-08-19
- Google 公开 AVDH 框架:智能体自动化挖掘代码漏洞 — rseroter · 2026-08-19
- pagedMark 工具:移除图片与视频的 AI 来源水印 — d0ofz · 2026-08-19
- Google 整合 A2A 架构引发身份与安全担忧 — CackleRooster · 2026-08-19