128GB Mac 实测 Qwen 3.8:更强但内存需求高

Julian Harris 在 MacBook Pro M5 Max / 128GB 上使用面向 Mac 的本地模型方案栈 MTPLX 实测 Qwen 3.8 系列。结果显示 Qwen 3.8 Flash Next 比 27B 模型更聪明也更快,但需约 80GB 内存;同时长上下文场景下吞吐量随上下文窗口扩大而显著下降,27B 模型吞吐甚至跌了一半,凸显本地部署大模型的算力与内存权衡。

2026-09-01 ~ 2026-09-01 · 2 条相关