Qwen3.8-27B 量化实测:MXFP4 数学反超 Q6,K/L 版代码最强但最慢

JurBank · reddit · 2026-10-12

Reddit 用户在 R9700 上对 Qwen3.8-27B 的三种量化版本做了横向实测,用 gsm8k(数学)和 humaneval(代码)在 Docker 容器中跑分。

结果与直觉相反:

作者原假设 Q6KL 精度最好、MXFP4 最差,实测基本全被推翻。发帖人同时请教:为何 MXFP4 数学第一、代码垫底?样本量(50-100 题)偏小,结论有待更大规模复现。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →