告别Token生成:新研究让大模型在隐空间进行推理

CShorten30 · x · 2026-08-04

当前大模型(LLM)的推理高度依赖显式的 Token 生成,导致延迟较高。作者提出了一种新方法:训练 LLM 在隐式的“潜在工作记忆”中进行推理。

这种方法无需输出完整的推理轨迹,使得首字延迟(TTFT)与直接回答无异。作者发布了一篇交互式博客文章,直观展示了这一机制的效果。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →