新研究揭示计算最优缩放取决于技能:记忆要参数,推理要数据
ml_perception · x · 2026-08-20
arXiv 新论文《Compute Optimal Scaling of Skills: Knowledge vs Reasoning》指出,LLM 的计算最优缩放行为是技能依赖的。研究发现,基于知识的任务(如 QA)和基于推理的任务(如代码生成)在缩放行为上存在根本差异:记忆型任务更需要参数,而推理型任务更需要数据。此外,研究还发现验证集的技能组成若未校准,可能导致计算最优参数数量偏差近 50%。
「模型」频道最新
- Dots Studio 开源递归自我改进模型,主打自我批评机制 — omarsar0 · 2026-08-20
- dots3-note 展示环境交互、假设验证与记忆更新能力 — omarsar0 · 2026-08-20
- dots3-note Preview 展示未知环境适应与自迭代能力 — omarsar0 · 2026-08-20
- dots3-note 模型发布:280B 参数与自评估任务进展能力 — omarsar0 · 2026-08-20
- 彭博让七大AI代理比拼vibe coding,测中美谁领先 — pstAsiatech · 2026-08-20
- Frontier Radar:中国模型已追赶,西方 AI 优势还剩多少? — The Decoder · 2026-08-20