DeepSeek V4 Flash 的 KV Cache 量化质量显著下降

erazortt · reddit · 2026-08-03

开发者对 DeepSeek V4 Flash(DS4F)模型将 KV Cache 从 BF16 量化至 Q8 的质量影响进行了详细测试,结果显示其性能出现了显著下降,建议不要对该模型进行 KV 量化。

核心数据对比:

这表明,与部分对量化容忍度较高的模型不同,DeepSeek V4 Flash 对 KV Cache 量化非常敏感,强行量化会导致明显的生成质量受损。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →