Qwen3.8 实测:MTP 参数影响吞吐,Q4 精度胜过 Q8

New-Inspection7034 · reddit · 2026-08-17

作者在 RTX Pro 6000 Blackwell 上深度测试 Qwen3.8-27B (GGUF) 与 agent harness,发现性能调优与量化精度的反直觉结论:

1. MTP 参数不通用,需按版本重调

2. Q4 量化反超 Q8

3. reasoningeffort > 量化精度

4. 模型升级暴露工具链 Bug

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →