mlx-dspark 让 Qwen3.8-27B 在苹果芯片上提速 3 倍

A-Rahim · reddit · 2026-08-15

mlx-dspark 是 DeepSeek DSpark 投机解码的 MLX 移植版,新增对 Qwen3.8-27B 的支持,在 Apple Silicon 上实现无损加速。在 M4 Pro 48GB 上,8-bit 量化平均提速 2.45 倍(数学 3.0 倍、代码 2.38 倍、聊天 1.96 倍),代码运行最高达 3.18 倍,速度从 8.3 提升至 20.3 tok/s;4-bit 量化提速 1.74 倍,达 25.3 tok/s。有趣的是,8-bit 加投机解码(20-27 tok/s)比纯 4-bit(14.6 tok/s)更快,兼顾质量与速度。项目提供 OpenAI 兼容服务器和 Anthropic Messages API,可配合 Claude Code 使用,并支持原生 Mac 应用。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →