Mac 本地跑模型:MLX 与 GGUF 该怎么选

Ok_Warning2146 · reddit · 2026-09-13

Reddit 帖讨论 Mac 上两种主流本地模型格式的取舍:GGUF 目前主要由 llama.cpp 的 Metal 后端服务,MLX 则由 mlx(omlx)或 vllm-mlx 服务。楼主询问同量化尺寸下两者速度与性能孰优、是否还有其他引擎、以及是否存在能直接服务 HF safetensors 目录的引擎。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →