研究称测试时推理时代 Chinchilla 20 token/参数是最优比已失效

josh_wills · x · 2026-09-05

数据公司 Datology AI 发布 Nicholas Roberts 的演讲,提出新的 Train-to-Test(T²)缩放定律:将 pass@k 纳入预训练缩放框架后,一旦模型具备测试时推理能力,计算最优策略会大幅偏向「小模型 + 超量数据」。

该观点对预训练配方与算力分配有直接指导意义。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →