M2 Ultra 运行 Qwen3.8-27B 速度基准测试实录

planetearth80 · reddit · 2026-08-18

一位用户在配备 192GB 内存的 Mac Studio M2 Ultra 上运行 llama.cpp,对 Qwen3.8-27B (Q6KXL) 量化模型进行了详细的基准测试。帖子列出了具体的编译版本、模型参数、llama-bench 测试标志及结果数据,并分享了实际服务部署时的启动参数配置。作者希望与其他 Mac Ultra 用户对比数据,以优化推理性能。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →