M5 Max 本地跑 ds4 约 20 token/s,求最新开源模型推荐

A_Wild_Entei · reddit · 2026-09-06

一位 M5 Max 用户分享本地部署经验:此前跑 antirez 的 ds4 可达约 20 token/s,速度满足个人使用。他表示 Qwen、DeepSeek V4 视觉版和 GLM 近期进展明显,想了解量化等级对性能的影响,并征求当前本地最优模型选择与实测速度。帖子主要面向 Mac 端侧部署开源模型的玩家交流。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →