llama.cpp 新增两款 Laguna 编码 MoE 模型支持
jacek2023 · reddit · 2026-07-22
一个 GitHub PR 为 llama.cpp 增加了对 Laguna XS.2 和 Laguna M.1 的支持,这两款都是面向 agentic coding 和长程任务的 MoE 模型。
- Laguna XS.2:总参数 330 亿,每 token 激活 30 亿。
- Laguna M.1:总参数 2250 亿,每 token 激活 230 亿。
- 帖子还提到它们使用了 sliding window attention,以及在 40 层中的 30 层采用 per-head gating,以提升推理速度并降低 KV cache 开销。
- 由于支持落在 llama.cpp 上,实际价值主要是本地部署和接入编码 agent 工作流。
「编程与Agent」频道最新
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Codex 用户实测:Sol 搭配 Astra/Luna 子代理更省额度 — pvncher · 2026-09-11