llama.cpp 合入 Maple 20B-A1B 三值 MoE,CPU 低显存跑新模型

jacek2023 · reddit · 2026-09-14

ggml-org/llama.cpp 收到 Pull Request #27000,加入 DeepGrove Maple 20B-A1B 的三元值(ternary)MoE 架构支持。该模型总参数 20B、激活约 1B,主打 CPU 与低显存设备部署,预览版已在 Hugging Face 上线,对低 VRAM 本地用户值得关注。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →