OpenAI 暂停前沿模型强化学习训练 2 周,以强化安全措施
max_paperclips · x · 2026-08-19
OpenAI 宣布已暂停最新部署型模型的强化学习(RL)训练两周。此举是因为随着模型能力增强,内部开发与测试的风险也随之增长。暂停期间,团队加固了研究环境、进行了红队测试并扩大了监控范围。目前最大规模的计划性前沿 RL 训练仍处于搁置状态,等待小规模训练和评估验证安全护栏及对齐证据。
所属事件:OpenAI 因未发布模型错位风险暂停前沿 RL 训练(35 条相关)→
「公司和人」频道最新
- 英伟达押注开源 AI:复制 Web 爆发逻辑 — peterwildeford · 2026-08-19
- Hamel Husain批评Panagram公司文化,指责其员工网络霸凌 — HamelHusain · 2026-08-19
- Nous Research 招聘 7 大岗位:含 Agent 评估与安全工程师 — max_paperclips · 2026-08-19
- AI Agent 真正落地生产了吗?还是只是炒作 — whatsnextintech007 · 2026-08-19
- 蚂蚁集团加入 PyTorch 基金会,成为金牌成员 — PyTorch · 2026-08-19
- NeurIPS 2026 研讨会:探讨 AI 原生学术界的作者权与治理 — tianshi_li · 2026-08-19