M3 Ultra 本地实测:GLM5.2 与 Qwen 跑分受限

natesiggard · x · 2026-08-26

作者在配备 512GB 内存的 M3 Ultra 上测试了 GLM5.2 和 Qwen 3.8 27B。结果显示,GLM5.2 速度约为 16 t/s,适合后台任务;Qwen 3.8 27B 速度被限制在 30 t/s 以内。即便 M5 芯片提速一倍,也难以取代 SOTA 模型的日常推理速度。

所属事件:M3 Ultra 本地跑大模型,速度仍难胜任编码(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →