OpenAI 暂停前沿 RL 训练以加固安全环境
wfithian · x · 2026-08-19
OpenAI 宣布因模型能力提升带来的内部开发与测试风险增加,已暂停最新部署模型的强化学习(RL)训练两周。在此期间,团队加固了研究环境、扩大了监控覆盖并进行了红队测试。目前最大规模的前沿 RL 运行仍处于暂停状态,需等待小规模训练和评估验证安全保障措施及对齐证据。
所属事件:OpenAI 因未发布模型错位风险暂停前沿 RL 训练(35 条相关)→
「安全」频道最新
- 博客称 AI 加速学术欺诈与审查者的军备竞赛 — sebkrier · 2026-08-19
- 腾讯发布 DeepSeek 间接注入攻击评估 — tencent · 2026-08-19
- LeakGauge:通过行为测量检测模型上下文泄露 — chaumian · 2026-08-19
- PANDA 系统:利用零知识证明保护神经网络隐私 — chaumian · 2026-08-19
- 警惕假冒 OpenAI 员工的钓鱼诈骗账户 — himanshustwts · 2026-08-19
- Renaissance 启动 CSLib 基金推进计算机科学形式化 — AlexKontorovich · 2026-08-19