M3 Max 上实测 Qwen 3.8 27B 与 Qwen Flash Next:体感几乎一致

Zeeplankton · reddit · 2026-09-07

发帖人在 M3 Max 96GB 上本地运行 Qwen 3.8 27B 与 Qwen Flash Next,两者体感基本相同,但 27B 的 prefill 更快;顺带问有没有人在做提升 MLX prefill 性能的工作。

分支问题:有没有支持「完全关闭推理」的 harness?起因是 JetBrains 博客透露其 Junie 使用 Qwen 3.6 时完全关闭推理模式。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →