MTPLX 让苹果 Silicon 本地推理提速 3 倍
julianharris · x · 2026-08-25
开发者发布了 MTPLX,这是一款针对 Apple Silicon 的原生 Mac 应用和命令行工具,利用现代模型(如 Qwen 3.8)自带的 MTP 头实现多令牌预测,使本地模型运行速度提升约 3 倍。实测对比显示,在配备 MTPLX 的 M3 上运行 Qwen 3.8 27B 的体验,远超未优化时虽能运行更大模型但 prefill 极慢的 M3 Max。
「Infra」频道最新
- 双节点 GB10 Spark 集群应选何引擎运行 LTX/Wan/MiniMax — ElSrJuez · 2026-08-25
- .NET 开发者吐槽:用 ONNX 跑 Whisper 太复杂 — SecondCobra · 2026-08-25
- 苏格兰拟建全球第二大数据中心,遭 1600 人反对 — nordicinst · 2026-08-25
- 研究:量子处理器扩展需权衡规模与时空成本 — jwt0625 · 2026-08-25
- 传苹果新款 Mac mini 九月前发布,本地跑 AI 或成溢价卖点 — Scobleizer · 2026-08-25
- 澳大利亚预测 2036 年数据中心耗电将激增近 600% — Polymarket · 2026-08-25