实测发现 FFN 精度决定量化损耗,Qwen 微调模型实现极限压缩

enginetown · reddit · 2026-07-31

开发者对 Qwen3.6-27B-Fable-Fusion-711 模型进行了全组件组合 KLD 量化测试。与上次单独测试各权重组不同,本次构建了完整的量化模型并进行了真实测试与多轮修复。

关键发现:

作者最终输出了三个不同压缩级别的版本(3.90 到 3.33 BPW),所有测试类别的 KLD 散度均未越过红线,并坦诚列出了目前尚未覆盖的测试盲区(如数学和工具调用的极限压力测试),将最终风险评估交还给具体使用场景。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →