MTPLX V2发布:Mac本地大模型推理破80 TPS
专为苹果芯片优化的本地推理工具MTPLX V2正式发布。该工具引入Turbo模式,通过定制的量化矩阵乘法内核和编译验证步骤大幅提升性能。实测在MacBook Pro M5 Max上运行Qwen 3.6 27B模型时,推理速度可达82 token/秒。
2026-07-08 ~ 2026-07-09 · 2 条相关
- MTPLX V2发布:MacBook M5 Max跑Qwen 27B实测72+ token/秒 — awnihannun · 2026-07-08
- MTPLX V2发布:Mac端MLX模型推理达82 TPS — YoussofAl · 2026-07-09