Qwen3.8-27B 量化实测:MXFP4 数学反超 Q6,K/L 版代码最强但最慢
JurBank · reddit · 2026-10-12
Reddit 用户在 R9700 上对 Qwen3.8-27B 的三种量化版本做了横向实测,用 gsm8k(数学)和 humaneval(代码)在 Docker 容器中跑分。
结果与直觉相反:
- Swift-1.5 MXFP4(输出 Q6K):数学 gsm8k 最高(xhigh 思考档 0.96),速度最快(3.6-6.1 分钟),但代码 humaneval 最低(0.62-0.67)
- Swift Q6K:代码 0.76,速度却最慢(9.8-18.2 分钟)
- UD-Q6KL:代码最高(0.78-0.80),数学反而垫底(0.88-0.89)
作者原假设 Q6KL 精度最好、MXFP4 最差,实测基本全被推翻。发帖人同时请教:为何 MXFP4 数学第一、代码垫底?样本量(50-100 题)偏小,结论有待更大规模复现。
「Infra」频道最新
- OpenRouter 月 token 流量 18 个月从 2T 暴增至 379T,开源模型占 75% — Beth_Kindig · 2026-10-12
- 华硕 RTX 5090 显卡德国售价飙至 11079 欧元仅剩 3 块 — janusch_patas · 2026-10-12
- 双 DGX Spark 跑 DeepSeek-V4.1-Flash:TP2 补丁让首 token 从 33.8s 降至 4.9s — rez0__ · 2026-10-12
- Ed Zitron 算账:AI 公司年营收需约 4250 亿美元才能填平超大规模资本开支 — SumitGup · 2026-10-12
- DiffusionBear 用 MLX 4-bit 量化,让 16GB Mac 跑 FLUX.2 等大模型 — Puzzleheaded_Note739 · 2026-10-12
- mitsuhiko:Agent 沙盒没有银弹,VM、沙箱、JS 解释器各有适用场景 — mitsuhiko · 2026-10-12