MLX vs GGUF 对决:MLX 在 M5 Max 上更快更准

helloiamleonie · x · 2026-08-14

开发者 Ivan Fioravanti 发布了 vlm-bakeoff 测试,对比 MLX 和 GGUF 两种推理框架在 M5 Max 上的表现。测试了 Grok 4.6 和 LFM 2.5 VL 3B 等模型,结果显示 MLX(基于 mlx-vlm)在速度和结果上均优于 GGUF(基于 llamacpp)。他还提到为 MLX 提交了改进 PR,并发现 llamacpp 端的问题。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →