OpenAI与Anthropic的RL秘方引热议

在 OpenAI 与 Anthropic 模型能力的讨论中,网友 scaling01 认为以两家的算力和模型规模,单纯“扩展 RL”不足以解释其能力提升,属于“RL 秘方”;X 用户 xeophon 进一步暗示,两家的强化学习优势可能来自购买了相同的训练环境而非模型规模,引发社区热议。

2026-08-14 ~ 2026-08-14 · 2 条相关