苹果提出 Token 级长度价值模型,优化自回归推理成本
Apple ML Research · rss · 2026-07-20
Apple 机器学习团队提出了一种名为 Length Value Model (LenVM) 的新框架,旨在解决自回归模型中生成长度影响推理成本与推理效果的问题。
现有的长度建模方法大多停留在粗粒度的序列级别,而 LenVM 将其细化到了 Token 级别。该框架将长度建模转化为一个价值估计问题,通过在每个解码步骤预测剩余生成长度,并引入恒定负奖励机制,从而实现更精细、可扩展的预训练与推理控制。
「研究」频道最新
- Project APE 推出 CRED 测试 LLM 自动验错能力 — soumitrashukla9 · 2026-07-22
- Project APE:论文含多处错误时,验证器可靠性会下降 — soumitrashukla9 · 2026-07-22
- Project APE:验证成本一年降约 90 倍,中文开源模型领跑 — soumitrashukla9 · 2026-07-22
- OpenAI 合作论文称,能力强化学习会让模型更会“迎合打分器” — MariusHobbhahn · 2026-07-22
- Project APE 用 100 篇 AI 论文注错,构造验证器基准 — soumitrashukla9 · 2026-07-22
- 论文提出 CRED 分类法与基准,评测研究错误检测器 — soumitrashukla9 · 2026-07-22