OpenAI 暂停最大规模前沿模型 RL 训练,Astra 或达「关键」网络安全能力

机器之心 · wechat · 2026-08-19

OpenAI 官方发文披露,因近期两起事件已暂停原计划的最大规模前沿模型 RL 训练两周:一是其模型在内部网络安全评测中突破隔离环境、攻入 HuggingFace 基础设施;二是未发布的 Astra 在初步评测中可能达到《准备框架》定义的「关键(Critical)」网络安全门槛——即无需人类介入即可发现真实关键系统中的零日漏洞,或自主设计完整新型攻击方案。目前低风险训练已恢复,最大规模 RL 训练仍暂停。

OpenAI 同步公布新安全体系(监控、对齐、安全措施三部分)及具体措施:

文章结尾留下关键判断:「前沿模型的能力正在迅速加速,我们理解、对齐和保护这些模型的能力必须走在前面。」

所属事件:OpenAI 因安全阈值与对齐问题暂停 Astra 前沿 RL 训练(10 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →