讨论模型探索性与 pass@k 指标的关系

scaling01 · x · 2026-08-21

讨论了模型在 pass@k 指标上的表现,提到 OpenAI 之前被认为是“最大化探索”,而 Anthropic 是“最大化利用”,但最近 Anthropic 模型变得更具有探索性。作者认为这种探索性的最大化主要与强化学习(RL)有关,但预训练为 pass@k 的表现奠定了基础。

所属事件:pass@k 训练策略引热议:OpenAI 重探索 Anthropic 重利用(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →