M5 Max 本地跑 ds4 约 20 token/s,求最新开源模型推荐
A_Wild_Entei · reddit · 2026-09-06
一位 M5 Max 用户分享本地部署经验:此前跑 antirez 的 ds4 可达约 20 token/s,速度满足个人使用。他表示 Qwen、DeepSeek V4 视觉版和 GLM 近期进展明显,想了解量化等级对性能的影响,并征求当前本地最优模型选择与实测速度。帖子主要面向 Mac 端侧部署开源模型的玩家交流。
「Infra」频道最新
- Reddit 网友晒本地跑 AI 的硬件配置:大内存主机+轻终端远程访问 — Fun_Kangaroo512 · 2026-09-06
- 算力够吗?Reddit 热议自动化全部脑力劳动的能源门槛 — Vivid-Flamingo-644 · 2026-09-06
- 8GB 显存本地跑 200 tok/s:实测 6 款小模型选型指南 — TheMoonMidas · 2026-09-06
- 算力够吗?Reddit 热议自动化全部脑力劳动的能源门槛 — Vivid-Flamingo-644 · 2026-09-06
- llama.cpp 分块 KV cache 流式传输 PR:长上下文显存封顶 — giveen · 2026-09-06
- 华为科学家披露Logic Folding散热细节,密度近TSMC N3E水平 — teortaxesTex · 2026-09-06