OpenAI 暂停前沿 RL 训练,Astra 等新模型或延期数月
haider1 · x · 2026-08-19
Sam Altman 宣布 OpenAI 暂停部分前沿强化学习(RL)训练,以确保新能力的安全性、对齐与监控标准达标。评论认为这可能导致代号 Astra 的模型进一步延期,且短期内公共模型能力水平可能停滞数周甚至数月。
所属事件:OpenAI 因 Astra 触及关键安全阈值暂停前沿 RL 训练(8 条相关)→
「模型」频道最新
- GLM-5.3 评测指数达 60 分,仍是中国最强模型之一 — teortaxesTex · 2026-08-19
- Codex 新版破坏 subagents,回退 0.142.0 可规避 — chibop1 · 2026-08-19
- 让模型厂商自测基准,如同学生自己监考SAT — MattPerault · 2026-08-19
- Grok 4.6 金融尽调基准并列第二,单任务成本仅 0.84 美元 — karinanguyen · 2026-08-19
- Perplexity 上线美国托管 DeepSeek V4 Pro,WANDR 评测性价比出众 — perplexity_ai · 2026-08-19
- 智谱 GLM-5.3 上线,编码性能提升 50% — gaganghotra_ · 2026-08-19