Mac 本地大模型选型指南:16G 内存也能跑 27B 模型
JosephJacks_ · x · 2026-08-06
针对 Mac 用户的本地大语言模型(LLM)选型指南。作者按统一内存大小将 Mac 分为 6 个档次(8GB 到 96GB+),并在同一台 M3 Ultra 上实测了各档位最适合运行的模型及其峰值内存占用和冷启动时间。
- 8–15 GB:推荐 lfm2.5-2.6b-4bit,占用约 2.0 GB 内存。
- 16–23 GB:推荐 bonsai-27b-2bit,实测仅需 8.4 GB 内存即可流畅运行 27B 模型。
- 24–31 GB:推荐 gemma-4-26b-4bit。
- 32–63 GB:推荐 qwen3.6-35b-4bit。
- 64–95 GB:推荐 qwen3.6-35b-8bit。
- 96 GB+:推荐 qwen3.5-122b-mxfp4。
用户可通过官方提供的 curl | bash 脚本自动检测硬件并安装对应模型。
「Infra」频道最新
- 谷歌云 Filestore 引入 Colossus 底层,实现容量与 IOPS 独立扩展 — rseroter · 2026-08-06
- 8x DGX Spark 节点开放世界多智能体实测 — NVIDIAAI · 2026-08-06
- RTX 5090 本地大模型量化与 8GB 显存智能体性能基准测试 — max_paperclips · 2026-08-06
- 英伟达探讨基于专有数据构建安全的企业级 AI — nvidia · 2026-08-06
- 无需 GPU 也能跑:Chorus 开源预训练模型库支持 CPU 快速推理 — jmschreiber91 · 2026-08-06
- 单台 Spark 硬件跑 DeepSeek V4,本地推理速度达 95 tok/s — Rasmic · 2026-08-06