Qwen 3.8 登 Apple Silicon,社区提速超 150%

gajesh · x · 2026-08-16

MLX 社区针对 Qwen 3.8 27B 模型发起了在 Apple Silicon 上的性能优化挑战。在社区参与下,该模型在 Mac 上的运行速度已较基线提升 151%(解码速度达 53.3 tok/s)。该项目通过 speculative decoding 等技术探索本地大模型的加速极限。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →