剪枝 Q8 模型实验:Q4 体积换近 Q8 精度

有研究者在 Kimi K2 模型上探讨剪枝实验方案:若在 Q8 量化模型上剪枝部分专家(而非当前研究的 Q4),剪枝后的模型大小可降至当前未剪枝 Q4 版本(约 97GB)的量级。这意味着在保持现有 Q4 存储体积的前提下,有望获得接近 Q8 量化的更高精度。

2026-08-27 ~ 2026-08-27 · 2 条相关