Gemma 4 在 48GB Mac 上本地实测,MLX 对比 llama.cpp 和 Java 25
rseroter · x · 2026-07-28
这条帖在比较 Gemma 4 26B-A4B 如何在一台配备 48GB 统一内存的 Apple Silicon MacBook Pro 上本地运行。
- 场景是通过 Java 25 + LangChain4j 做全本地调用。
- 对比了 MLX、带 MTP speculative decoding 的 llama.cpp,以及纯 Java 25 路径。
- 重点不是模型发布本身,而是本地推理部署与性能的实测。
被引用的原帖还提到,Gemma 系列累计下载量已超过 9 亿次。
「Infra」频道最新
- Rat Stack:把应用和云写成一个类型化程序,让 AI agent 可靠地搭建部署 — samgoodwin89 · 2026-09-23
- optimAIzr:本地 CLI 找出 AI 用量浪费,支持 Claude Code 与 Codex 省钱 — stichstichstich · 2026-09-23
- 256GB 内存版 Mac Studio 二手溢价 6000 美元仍一机难求 — GabGarrett · 2026-09-23
- Ben Bajarin 解析 AI 数据中心:CPU 与内存如何限制 GPU 推理服务能力 — BenBajarin · 2026-09-23
- Epoch AI 报告:「思考」的价格正在暴跌,智能成本持续陡降 — Proper_Actuary2907 · 2026-09-23
- 从燃气到吉瓦:Diligence Stack 专家访谈拆解 AI 数据中心供电难题 — BenBajarin · 2026-09-23