128GB Mac 实测 Qwen 3.8 Flash Next:比 27B 更聪明更快,需约 80GB 内存
julianharris · x · 2026-09-01
Julian Harris 在 MacBook Pro 14" M5 Max / 128GB 上用 MTPLX(面向 Mac 的本地模型垂直方案栈)实测 Qwen 3.8:
- 27B 的吞吐随上下文窗口扩大明显下降;
- Flash Next("Qwen 4 preview",MoE 125-a6b 架构 + 4bit 量化 + ngram 缓存)下降幅度小得多,虽然仍不如云端 Opus,但整体更聪明、更快、更高效;
- 该配置约需 80GB 内存,基本只有 128GB Mac 可跑;flash-next 虽支持 offload,但据观察性能会「像石头一样沉下去」。更多细节将在其博客 AI Local 发布。
所属事件:128GB Mac 实测 Qwen 3.8:更强但内存需求高(2 条相关)→
「Infra」频道最新
- Milvus:云原生高性能向量数据库解析 — goyalshaliniuk · 2026-09-01
- Weaviate:支持对象与向量混合存储的数据库 — goyalshaliniuk · 2026-09-01
- 沙特 AI 公司合建红海 100 兆瓦数据中心 — Polymarket · 2026-09-01
- 32GB 内存+两块杂牌旧卡跑 Qwen3 27B,20t/s 本地编程可行但太慢 — pepijndevos · 2026-09-01
- 字节跳动 UBASE:万亿级向量数据的 AI 搜索引擎 — _reachsumit · 2026-09-01
- LinkedIn 提出基于 GPU 的语义检索框架 — _reachsumit · 2026-09-01