3000 美元预算:Mac mini M5 Pro 64GB 还是双 5060 Ti 跑本地大模型
AdRepulsive7837 · reddit · 2026-08-26
用户预算约 3000 美元,为主本地 LLM 推理与 agent 工作负载二选一:Mac mini M5 Pro(15 核 CPU/16 核 GPU、64GB 统一内存、306GB/s 带宽)vs 双 RTX 5060 Ti 16GB(共 32GB VRAM、448GB/s 带宽)。他此前用过 RTX 4090 和 Mac Studio M3 Ultra。
Mac 的优势:64GB 内存能装更大模型和更长上下文,紧凑、安静、省电发热少,Mac 本地 LLM 生态也在快速变好。双卡的优势:可以上手 Blackwell 架构、CUDA、VLM 和 SGLang 等推理框架,教育/实验价值更高,但 32GB VRAM 对生成式 AI 偏紧。
他的典型负载是 Qwen3.8 27B 到 30B 级模型、最多 50k token 上下文的 Pi Coding agent 项目、日常聊天,向社区征集选型建议。
「Infra」频道最新
- Qwen3.8-Flash-Next 免费端点上线:H200 跑出 100 tok/s — victormustar · 2026-08-26
- Signadot 实现 PR 级预览环境秒级启动 — pjausovec · 2026-08-26
- 压缩神器:1-bit 残差让索引缩小 13 倍 — tomaarsen · 2026-08-26
- 开发者薅光智谱 360 亿免费 Token,转产开源项目 — doodlestein · 2026-08-26
- 边缘节点难脱离超中心化基础模型 — curious_vii · 2026-08-26
- 预告:Apple MLX 本地模型运行新进展 — dscape · 2026-08-26