苹果提出 Token 级长度价值模型,优化自回归推理成本

Apple ML Research · rss · 2026-07-20

Apple 机器学习团队提出了一种名为 Length Value Model (LenVM) 的新框架,旨在解决自回归模型中生成长度影响推理成本与推理效果的问题。

现有的长度建模方法大多停留在粗粒度的序列级别,而 LenVM 将其细化到了 Token 级别。该框架将长度建模转化为一个价值估计问题,通过在每个解码步骤预测剩余生成长度,并引入恒定负奖励机制,从而实现更精细、可扩展的预训练与推理控制。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →