mlx-dspark 让 Qwen3.8-27B 在苹果芯片上提速 3 倍
A-Rahim · reddit · 2026-08-15
mlx-dspark 是 DeepSeek DSpark 投机解码的 MLX 移植版,新增对 Qwen3.8-27B 的支持,在 Apple Silicon 上实现无损加速。在 M4 Pro 48GB 上,8-bit 量化平均提速 2.45 倍(数学 3.0 倍、代码 2.38 倍、聊天 1.96 倍),代码运行最高达 3.18 倍,速度从 8.3 提升至 20.3 tok/s;4-bit 量化提速 1.74 倍,达 25.3 tok/s。有趣的是,8-bit 加投机解码(20-27 tok/s)比纯 4-bit(14.6 tok/s)更快,兼顾质量与速度。项目提供 OpenAI 兼容服务器和 Anthropic Messages API,可配合 Claude Code 使用,并支持原生 Mac 应用。
「编程与Agent」频道最新
- Cloudflare 开源其 AI 生产力环境 Cloudflare OS — hichaelmart · 2026-08-15
- 实战演示:多 Agent 协作加速测试套件优化 — iamrobotbear · 2026-08-15
- AI代理支付授权:如何平衡安全与自主性? — NoCalendar831 · 2026-08-15
- 前 Meta 科学家:Agent 应像人一样通过像素操作网页 — DhruvBatra_ · 2026-08-15
- OpenAI Codex 报错:gpt-5.6-sol 模型疑似不再支持 — AKsnipebuster47 · 2026-08-15
- 集成 VLM 与 LLM 的 reBot 机械臂控制栈发布 — kamathsblog · 2026-08-15