MindLab 开源 Macaron-V1:基于 GLM-5.2 的持续学习模型家族
机器之心 · wechat · 2026-07-24
MindLab 开源了 Macaron-V1,一套围绕 持续学习 和 多 LoRA 协作 设计的模型家族。
- 旗舰版 Venti 以冻结的 GLM-5.2 为底座,叠加 4 个 LoRA 专家,分别负责对话、Agent 任务、编程和生成式 UI。
- 文章的核心观点是:模型不该在训练结束后“停止成长”,而应把部署后的经验继续写回能力里。
- 其 Mixture-of-LoRA(MoL) 设计,把 LoRA 视为可写入、可演化的“本地状态”,而不只是廉价微调补丁。
- 文中还给出一组缩放实验:在大规模 MoE 模型上,基于 LoRA 的强化学习能以更低算力开销获得稳定收益,甚至在某些设置下优于全参数 RL。
- 工程上,MindLab 还配套了 MinT、MindForge、HCP、LongStraw 等系统,分别处理训练/服务对齐、智能体强化学习、统一 harness 协议和超长上下文 RL。
- 该发布同时开放了 Macaron-V1-Venti、Macaron-V1-Coding-Venti、Macaron-V1-Tall 的权重。
所属事件:MindLab 开源 Macaron-V1:押注持续学习路线(4 条相关)→
「编程与Agent」频道最新
- 象棋自动研究智能体自称拿下现代 LLM 微调博士 — amasad · 2026-07-24
- 内部排行榜曝光,AI 编程系统的真实用法一览 — charlieholtz · 2026-07-24
- Sqemo MCP 让 schema agent 按团队规则确定性命名 — Aggressive-Video-508 · 2026-07-24
- Codex Linux 分支接入 ChatGPT Work Realtime 语音 — jxnlco · 2026-07-24
- 长任务 agent 的失败更像环境问题而非提示词问题 — Confident_Analysis89 · 2026-07-24
- 作者分享 Claude、Lovable MCP、OpenAI 的构建栈 — MyCreativeOwls · 2026-07-24