OpenAI 员工:为加强安全暂缓前沿训练,安全信心将决定开发节奏
DKokotajlo · x · 2026-08-19
OpenAI 员工透露,为加强安全和监控,团队暂时放缓了部分前沿模型训练。最大的前沿 RL 训练计划仍处于暂停状态,目前正通过小规模训练和评估来测试保障措施并收集更多对齐证据。该员工预计对安全的信心将日益决定 AI 开发的步伐。
所属事件:OpenAI 暂停部分前沿 RL 训练,安全对齐成主因(26 条相关)→
「安全」频道最新
- Sam Altman 称放缓训练因未发布模型存在“不同程度错位” — Neurogence · 2026-08-19
- 宾州州长签署行政令,实施全美最严 AI 数据中心标准 — ivan_bezdomny · 2026-08-19
- 专家论前沿实验室恐惧:公司责任或致 deliberate slowdown — davidmanheim · 2026-08-19
- NeurIPS 2026 研讨会聚焦:AI 写作、AI 评审与学术治理 — ManlingLi_ · 2026-08-19
- Anthropic 8 月风险报告披露,揭示当前最佳模型存在 — TheZvi · 2026-08-19
- 偷走专有模型推理痕迹:加密设计的工程权衡全复盘 — bendee983 · 2026-08-19