mlx-dspark 在 M4 Pro Mac 上将 Gemma 4 提速约 3 倍
GlennCameronjr · x · 2026-07-26
mlx-dspark 在 Mac 上把 Gemma 4 的本地推理速度提到了约 3 倍。
- 配图是基于 M4 Pro 的 warm benchmark,使用 mlx-dspark --trials 3,分别测了 chat / code / math。
- Gemma-4 12B(8-bit) 提升最明显:数学 3.09×、对话 2.63×、代码 2.61×,速度约 49 tok/s。
- 表里还列出了 Qwen3.6-27B、Qwen3-14B、Qwen3-8B、Qwen3-4B、Ornith-1.0-9B、Ternary-Bonsai-27B 等模型的提速结果。
- 核心信息是:Mac 本地跑模型的推理栈又有了可观的性能提升,而且不同模型/任务的收益差异很大。
「Infra」频道最新
- 多机多卡如何组网?本地部署大模型硬件配置求助 — BinaryGrind · 2026-07-26
- ASML EUV 光刻机:20G 加速度下保持 5 个原子精度 — ZeroStateReflex · 2026-07-26
- Jack Dorsey 的 Buzz 把共享算力做成社区级 AI 协作层 — MarvinTBaumann · 2026-07-26
- AWS、Google、Azure 和 Cloudflare 都在做 agent 沙箱 — krishnan · 2026-07-26
- Alphabet 上调 2026 CapEx 至 1950 亿美元,AI 股却在回调 — tengyanAI · 2026-07-26
- MCP 预览版加入无状态扩展和企业级授权 — davemccollough · 2026-07-26