Mac Studio M5 Ultra 本地运行 320B 模型仅需两万美分之一成本

SumitGup · x · 2026-08-29

实测数据显示,Apple Silicon 的统一内存架构非常适合本地运行大模型。配备 512GB 内存的 Mac Studio M5 Ultra 可完整装载 FP8 格式的 GLM-5.3-Flash (320B) 模型,离线推理速度约 60 tokens/s。而在 PC 端达到同等显存配置需 10 张 RTX 5090,成本超过 2 万美元,且功耗巨大。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →