曝 OpenAI 与 Anthropic 曾暂停 RL 训练
tszzl · x · 2026-09-01
推文引用消息称,OpenAI 和 Anthropic 都进行了一次小规模的 RL(强化学习)训练暂停。推文作者将其称为“追赶前沿的成功故事 (?))”,并建议下次应主动进行,以免发生失控事件。
「公司和人」频道最新
- 开发者观点:快速行动需忘却所有限制 — KlausCodes · 2026-09-01
- 行业术语“pacing the frontier”被赞将载入史册 — tszzl · 2026-09-01
- 企业数据战略:是出售数据还是自建微调护城河? — johnschulman2 · 2026-09-01
- 苹果指控 OpenAI 销毁商业机密案证据,疑涉 Agent 获取 — Key_Reading_9664 · 2026-09-01
- 快手可灵AI融资超204亿,大基金三期入股二季度营收8.5亿 — 智东西 · 2026-09-01
- Perplexity CEO 暗示明天与苹果有重大动作 — AravSrinivas · 2026-09-01