M3 Max 上实测 Qwen 3.8 27B 与 Qwen Flash Next:体感几乎一致
Zeeplankton · reddit · 2026-09-07
发帖人在 M3 Max 96GB 上本地运行 Qwen 3.8 27B 与 Qwen Flash Next,两者体感基本相同,但 27B 的 prefill 更快;顺带问有没有人在做提升 MLX prefill 性能的工作。
分支问题:有没有支持「完全关闭推理」的 harness?起因是 JetBrains 博客透露其 Junie 使用 Qwen 3.6 时完全关闭推理模式。
「Infra」频道最新
- 传统私募信贷避而远之,算力融资风险将流向对冲基金与大宗商品交易商 — AccBalanced · 2026-09-08
- 开发者 1.5 年业余造出 Jenny:本地 LLM 桌面端,MIT 开源 — TangySword · 2026-09-08
- Cacheon 开设 GLM-5.3 内核竞技场,优化推理内核日奖励可达 33 TAO — JosephJacks_ · 2026-09-08
- 约翰霍普金斯报告:AI 耗电激增,美国电网需战略孤岛化防大停电 — philvenables · 2026-09-08
- 高带宽闪存 HBF 算账:约 4900 个 NAND 平面并发才能匹敌 H200 — lauriewired · 2026-09-08
- BMO 分析:美国电力需求创新高,增量主要由可再生能源与储能满足 — aronchick · 2026-09-08