MTPLX V2发布:Mac本地大模型推理破80 TPS

专为苹果芯片优化的本地推理工具MTPLX V2正式发布。该工具引入Turbo模式,通过定制的量化矩阵乘法内核和编译验证步骤大幅提升性能。实测在MacBook Pro M5 Max上运行Qwen 3.6 27B模型时,推理速度可达82 token/秒。

2026-07-08 ~ 2026-07-09 · 2 条相关