Qwen3.8-27B 开启 thinking 耗时增加 6 倍但质量显著提升
DerTomsn · reddit · 2026-08-30
在 Apple M5 Max 上的基准测试显示,Qwen3.8-27B 模型在开启 thinking (xhigh) 模式后,Token 消耗增加 5.5 倍,运行时长增加 6 倍,但输出质量有巨大提升。完全关闭 thinking 会显著降低质量,使其表现落后于 Qwen3.6-35B-A3B 等其他 MoE 模型,尽管后者推理速度更快。
「模型」频道最新
- heretic:全自动给大模型「去审查」,GitHub 已近 2.9 万星 — p-e-w · 2026-08-30
- 实测:少量配置即可让 Claude 协助盗版与逆向工程 — adonis_singh · 2026-08-30
- 前员工直言:浏览器使用OpenAI碾压,Claude只剩编码强项 — bindureddy · 2026-08-30
- 大模型长上下文能力衰退严重,Token 效率差异揭示黑盒难题 — zakelfassi · 2026-08-30
- Claude Opus 5 评测:基准飙升但日活体验翻车 — gerardsans · 2026-08-30
- 「字母b的曲线对模型不可见」:分词盲区梗再翻红 — rickasaurus · 2026-08-30