实测:Qwen 27B 在苹果芯片提速 170%,推翻性能瓶颈认知

gajesh · x · 2026-08-16

针对此前认为 Mac 不适合运行稠密模型的共识,最新的优化工作在 Apple Silicon 上取得了显著突破。在运行 Qwen 3.8 27B 模型时,通过推测解码(speculative decoding)等技术手段,在 16 小时的优化后实现了比基线高 153%、比开箱即用的 MTP 解码快 2.5 倍的性能提升。这表明在算力受限端侧进行高性能 AI 推理仍有很大优化空间。

所属事件:Qwen 27B 在苹果芯片提速超150%(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →