Mac端推理速度飙升80%,开源社区突破性能极限

gajesh · x · 2026-07-30

Laguna XS 2.1 在 Mac 上的推理速度实现了 80.6% 的显著提升,且未使用投机解码(speculative decoding)。

此前内部智能体优化仅达到 36.6%,开发者原本预估的理论极限为 62%。通过开放挑战,社区开发者(@zkasv 和 @bbuddhaxyz)将性能进一步推升至 80.6%。

性能飞跃得益于 Apple Silicon Metal Kernels 的深度优化。这再次证明了开源协作在加速技术突破方面的巨大潜力。

所属事件:开源社区突破极限:Mac端大模型推理提速超80%(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →