MLX-VLM登顶Apple Silicon推理速度榜,36.4 tok/s刷新纪录
andrejusb · x · 2026-08-16
MLX-VLM 被宣称为 Apple Silicon 上最成熟、先进且最快的推理引擎。在 M3 Max 96GB 上的测试中,MLX-VLM 达到 36.4 tok/s,超过 Ollama 的 29.0、MTPLX 的 25.3 等。该引擎已支持 Nativ AI,并拥有 200+ 贡献者。
「Infra」频道最新
- AI下一个瓶颈是电力,算力并非唯一制约 — ingliguori · 2026-08-16
- 1bit量化让Qwen 27B在12GB显存跑出92 tokens/s — zyxciss · 2026-08-16
- 谷歌HEIR编译器开源,实现不解密AI推理 — heypearlai · 2026-08-16
- GLM 5.3 更新速率引热议,算力对比 DeepSeek — teortaxesTex · 2026-08-16
- 阿里发布 Zhenwu M890 超级节点,单集群支持 12.2 万卡 — pstAsiatech · 2026-08-16
- R1推理速度达150 tps,是DeepSeek的7倍 — teortaxesTex · 2026-08-16