MLX vs GGUF 对决:MLX 在 M5 Max 上更快更准
helloiamleonie · x · 2026-08-14
开发者 Ivan Fioravanti 发布了 vlm-bakeoff 测试,对比 MLX 和 GGUF 两种推理框架在 M5 Max 上的表现。测试了 Grok 4.6 和 LFM 2.5 VL 3B 等模型,结果显示 MLX(基于 mlx-vlm)在速度和结果上均优于 GGUF(基于 llamacpp)。他还提到为 MLX 提交了改进 PR,并发现 llamacpp 端的问题。
「模型」频道最新
- The Information:OpenAI 等美系模型实际使用成本低于中国竞品 — i_dg23 · 2026-08-14
- Gemini 3.7 Flash 实测:速度极快且便宜,性能比肩 Kimi K3 — bindureddy · 2026-08-14
- Scale AI CEO 转发对比:Muse Spark 1.2 定价仅为 Gemini 3.7 Flash 的十八分之一 — alexandr_wang · 2026-08-14
- 多智能体环境观察:Sol模型表现出异常的消极与被动 — repligate · 2026-08-14
- 大模型梯队再排位:Fable 5 遥遥领先,Sol 与 Opus 同居 T0 — bindureddy · 2026-08-14
- 多智能体环境实测:Sol 模型展现出极强的主导与编排倾向 — repligate · 2026-08-14