KV cache 最易被误解的一点:token 可以先生成,后进缓存

techNmak · x · 2026-09-18

作者澄清了 decoder-only Transformer 中 KV cache 的一个常见误解:并非所有 token 以相同方式经过 LLM。

核心结论:一个 token 可以在它被处理进 KV cache 之前就已经生成——这个先后顺序差异对理解解码细节很重要。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →