DeepSeek 九个月将 KV 缓存压缩 54 倍,token 效率看齐 OpenAI

据 X 用户 zephyrz9 统计,DeepSeek 过去九个月将每 token 的 KV 缓存体积压缩了 54 倍,最新模型每 token 仅约 890 字节。分析者 teortaxesTex 认为这看似简单的架构变化意义重大,将显著提升 token 效率,使 DeepSeek 走向 OpenAI 式的效率区间,不再需要「胖鲸吃白饭」式冗余;他还指出新发布内容带有 ChatGPT 的风格痕迹,并期待长上下文评测验证极致压缩下长文能力是否受损。

2026-09-10 ~ 2026-09-10 · 4 条相关