M3 Max 36GB 本地推理实测:Qwen3.6 MoE 达 110 tok/s

Hyungsun · reddit · 2026-10-05

作者花约 2498 美元购入 14 核 M3 Max MacBook Pro(36GB),在 macOS 27 上对比四款本地推理引擎(oMLX 0.7.0、Rapid-MLX 0.15.5、Splash 1.2.1、MTPLX 2.12.2),统一 temperature 0、关闭思考模式,每组测 3 次取中位数。

核心结果(decode,自然散文提示词):

其他发现:

结论:按你主用的模型选引擎即可,差距不大时选功能顺手的。作者因日常用 MoE 留下了 Rapid-MLX。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →