剪枝 Q8 模型实验:Q4 体积换近 Q8 精度
有研究者在 Kimi K2 模型上探讨剪枝实验方案:若在 Q8 量化模型上剪枝部分专家(而非当前研究的 Q4),剪枝后的模型大小可降至当前未剪枝 Q4 版本(约 97GB)的量级。这意味着在保持现有 Q4 存储体积的前提下,有望获得接近 Q8 量化的更高精度。
2026-08-27 ~ 2026-08-27 · 2 条相关
- 实测:剪枝 Q8 量化模型可达 Q4 大小与精度提升 — EyalToledano · 2026-08-27
- 剪枝 Q8 专家可获 Q4 模型大小与精度 — EyalToledano · 2026-08-27