Qwen3.8-27B 开启 thinking 耗时增加 6 倍但质量显著提升

DerTomsn · reddit · 2026-08-30

在 Apple M5 Max 上的基准测试显示,Qwen3.8-27B 模型在开启 thinking (xhigh) 模式后,Token 消耗增加 5.5 倍,运行时长增加 6 倍,但输出质量有巨大提升。完全关闭 thinking 会显著降低质量,使其表现落后于 Qwen3.6-35B-A3B 等其他 MoE 模型,尽管后者推理速度更快。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →