失控事件仅两周后,OpenAI 恢复训练更强 AI 且监控难度更高
DavidSKrueger · x · 2026-09-03
Harlan 更新爆料:OpenAI 与 Anthropic 曾因近期的「失控 AI 事件」暂停部分 RL(强化学习)训练。但仅仅两周后,OpenAI 就恢复训练更强的 AI,且所采用的技术会让监督监控变得更加困难——而该公司尚未真正解决对既有技术的控制问题。帖子隐含的批评是:在安全能力未跟上之前重启更强模型的训练,风险值得关注。
所属事件:OpenAI 被曝已恢复大规模强化学习训练(2 条相关)→
「模型」频道最新
- AI 自称能 vividly 看图,实际却「一片黑暗」 — yeastsplainer · 2026-09-03
- Every 写作基准首次纳入 Gemini 3.8 Flash、Grok 4.6 与 Muse Spark 1.3 — danshipper · 2026-09-03
- Meta Muse Spark 1.3 上架 OpenRouter:1M 上下文主打长程 Agent 工作流 — armand_ruiz · 2026-09-03
- DeepSeek-V4-Pro 正式版发布:1.6T 参数 MoE,开源评测 Harness 同步亮相 — DeepLearningAI · 2026-09-03
- 让 AI 互相较劲:跨厂商模型互审大幅提升代码质量 — rseroter · 2026-09-03
- Gemini 被问 AI 意识问题,给出细腻独特回答 — aiamblichus · 2026-09-03