MLX Fast 将 Qwen 3.8 27B 在 Mac 上提速 153%

alexcovo_eth · x · 2026-08-17

开发者分享 MLX Fast 在 Qwen 3.8 27B 模型上的优化进展:运行不到 16 小时,性能相比基准提升 153%,比原生 MTP 解码快 2.5 倍。该工具针对 Apple Silicon 架构优化,利用推测解码等技术挑战“Mac 擅长 MoE 但不擅长稠密模型”的普遍观念。

所属事件:MLX挑战赛让Qwen 27B在Mac上提速逾150%(4 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →