Meta 研究提出 Sharpening Tax:后训练提升首试精度却收窄解空间
iScienceLuvr · x · 2026-10-02
Meta(Superintelligence Labs)研究团队提出 Sharpening Tax(锐化税),量化后训练对模型测试时扩展能力的损失。核心发现:仅带轻量推理框架的预训练模型可作能干的 agent,虽然 pass@1 准确率远低于后训练版本,但在足够测试预算下 pass@K 覆盖率常反超。后训练会把任务成功率推向 0% 或 100% 两个极端。团队还提出 posterior-tempered group sampling(PTGS),一个即插即用的贝叶斯采样器,按 prompt 估计难度自适应调整采样温度。
所属事件:Meta 提出锐化税:后训练提升首试精度却收窄解空间(4 条相关)→
「研究」频道最新
- OpenAI 安全研究 VP 翁荔公开博客写作七步法 — SinclairWang1 · 2026-10-02
- Arena.ai 发布 HarnessTax:编码 Agent 的 harness 到底影响多大 — solyarisoftware · 2026-10-02
- 伯克利论文:LLM 记得你的新指令却仍用旧选择 — rohanpaul_ai · 2026-10-02
- 模型权重不动,Harness 自进化:Terminal-Bench 成绩 47.57 升至 52.43 — jiqizhixin · 2026-10-02
- 3 万对艺术二维码错觉数据集开源:多解码器验证+鲁棒性评分 — 1roOt · 2026-10-02
- 澄清:Google Diffusion Controller 的 90% 胜率与灰盒设定是两回事 — Crescitaly · 2026-10-02