讨论模型探索性与 pass@k 指标的关系
scaling01 · x · 2026-08-21
讨论了模型在 pass@k 指标上的表现,提到 OpenAI 之前被认为是“最大化探索”,而 Anthropic 是“最大化利用”,但最近 Anthropic 模型变得更具有探索性。作者认为这种探索性的最大化主要与强化学习(RL)有关,但预训练为 pass@k 的表现奠定了基础。
所属事件:pass@k 训练策略引热议:OpenAI 重探索 Anthropic 重利用(2 条相关)→
「模型」频道最新
- Grok 4.6 追平 Claude Opus 5,并列 Agentic Index 第一 — elonmusk · 2026-08-21
- DeepSeek V4 Pro 跑分 KernelBench,逼近 Opus 5 — teortaxesTex · 2026-08-21
- Liquid AI 推出 DSpark 草稿模型,加速达 4 倍 — JosephJacks_ · 2026-08-21
- 用户反馈 Qwen Uncensored 仍频繁拒答 — BLUECOW009 · 2026-08-21
- Pander Score 榜单揭示主流模型阿谀奉承程度差异 — RobbWiller · 2026-08-21
- Liquid AI 推出 DSpark:推测解码提速最高 3.18 倍 — helloiamleonie · 2026-08-21