llama.cpp 合入 Maple 20B-A1B 三值 MoE,CPU 低显存跑新模型
jacek2023 · reddit · 2026-09-14
ggml-org/llama.cpp 收到 Pull Request #27000,加入 DeepGrove Maple 20B-A1B 的三元值(ternary)MoE 架构支持。该模型总参数 20B、激活约 1B,主打 CPU 与低显存设备部署,预览版已在 Hugging Face 上线,对低 VRAM 本地用户值得关注。
「Infra」频道最新
- 欧洲内存价格松动:30 天跌 6-7%,意大利比德国还便宜 — egudegi · 2026-09-14
- 苹果 A20 Pro 单核跑分近 4000,领先 x86 约 25% — lemire · 2026-09-14
- 建数据中心最快之国可拉动葡萄牙 GDP 增 1%-2% — dscape · 2026-09-14
- Claude 用量加成取消,「算力大紧缺」或已开始 — jacob_posel · 2026-09-14
- 八万亿美元数据中心豪赌遭工会抵制:暂停新建直到工人权益受保护 — nordicinst · 2026-09-14
- SK 海力士完成 HBM4 内部认证,HBM 进入定制基底裸片竞争时代 — blaizedsouza · 2026-09-14