M5 Pro 64GB 本地跑 Qwen 实测:仅约 20 tok/s,长上下文更慢

rJohn420 · reddit · 2026-09-13

楼主分享 M5 Pro 64GB 本地运行大模型的体验:跑 Qwen 3 27B 左右可获得约 20 tok/s 的持续速度(前 2-4k token 约 30 tok/s),但模型思考量大导致实际体验偏慢;尝试 antirez 的 DS4 时,DeepSeek V4 Flash 持续速度只有约 8 tok/s,基本不可用。评论区征集同配置用户的本地模型选择。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →