Qwen 3.8 27B 对比 3.6:质量升 8%,耗时却长 5 倍

DerTomsn · reddit · 2026-09-04

用户在 oMLX 上对比 Qwen 3.8 27B 与 Qwen 3.6 27B:质量分从 81.1 升至 87.7(+8%),但速度从 35 降到 29 tok/s(-16%),运行时间从 8 分 51 秒暴增到 44 分 39 秒(5 倍),输出 token 从 18K 涨到 78K。结论是新模型明显更聪明,但代价是 token 消耗与时间大幅上升。完整多硬件、多量化对比见 llm-bench.io。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →