128GB Mac 实测 Qwen 3.8:更强但内存需求高
Julian Harris 在 MacBook Pro M5 Max / 128GB 上使用面向 Mac 的本地模型方案栈 MTPLX 实测 Qwen 3.8 系列。结果显示 Qwen 3.8 Flash Next 比 27B 模型更聪明也更快,但需约 80GB 内存;同时长上下文场景下吞吐量随上下文窗口扩大而显著下降,27B 模型吞吐甚至跌了一半,凸显本地部署大模型的算力与内存权衡。
2026-09-01 ~ 2026-09-01 · 2 条相关
- Qwen 2.5 72B 本地实测:长上下文吞吐跌一半 — julianharris · 2026-09-01
- 128GB Mac 实测 Qwen 3.8 Flash Next:比 27B 更聪明更快,需约 80GB 内存 — julianharris · 2026-09-01