M3 Ultra 本地实测:GLM5.2 与 Qwen 跑分受限
natesiggard · x · 2026-08-26
作者在配备 512GB 内存的 M3 Ultra 上测试了 GLM5.2 和 Qwen 3.8 27B。结果显示,GLM5.2 速度约为 16 t/s,适合后台任务;Qwen 3.8 27B 速度被限制在 30 t/s 以内。即便 M5 芯片提速一倍,也难以取代 SOTA 模型的日常推理速度。
所属事件:M3 Ultra 本地跑大模型,速度仍难胜任编码(2 条相关)→
「Infra」频道最新
- 软件人不懂芯片制造:AlphaChip 只是冰山一角 — saranormous · 2026-08-26
- 英伟达 BlueField 4 CPU 架构支持租户网络流量隔离 — bookwormengr · 2026-08-26
- NVIDIA Vera Rubin NVL72 机架投产,单托盘组装仅需一分钟 — nvidia · 2026-08-26
- 硬件价格难回旧低,万元预算如何选 LLM 算力 — nemuro87 · 2026-08-26
- 一张DGX Spark的钱能搭双3090加128G内存 — QuixiAI · 2026-08-26
- 用 MLX 在 Mac 上训练 iMessages 私有模型 — romainhuet · 2026-08-26