曝 OpenAI 与 Anthropic 曾暂停 RL 训练

tszzl · x · 2026-09-01

推文引用消息称,OpenAI 和 Anthropic 都进行了一次小规模的 RL(强化学习)训练暂停。推文作者将其称为“追赶前沿的成功故事 (?))”,并建议下次应主动进行,以免发生失控事件。

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →