MindLab 开源 Macaron-V1:基于 GLM-5.2 的持续学习模型家族
机器之心 · wechat · 2026-07-24
MindLab 开源了 Macaron-V1,一套围绕 持续学习 和 多 LoRA 协作 设计的模型家族。
- 旗舰版 Venti 以冻结的 GLM-5.2 为底座,叠加 4 个 LoRA 专家,分别负责对话、Agent 任务、编程和生成式 UI。
- 文章的核心观点是:模型不该在训练结束后“停止成长”,而应把部署后的经验继续写回能力里。
- 其 Mixture-of-LoRA(MoL) 设计,把 LoRA 视为可写入、可演化的“本地状态”,而不只是廉价微调补丁。
- 文中还给出一组缩放实验:在大规模 MoE 模型上,基于 LoRA 的强化学习能以更低算力开销获得稳定收益,甚至在某些设置下优于全参数 RL。
- 工程上,MindLab 还配套了 MinT、MindForge、HCP、LongStraw 等系统,分别处理训练/服务对齐、智能体强化学习、统一 harness 协议和超长上下文 RL。
- 该发布同时开放了 Macaron-V1-Venti、Macaron-V1-Coding-Venti、Macaron-V1-Tall 的权重。
所属事件:MindLab 开源 Macaron-V1:押注持续学习路线(4 条相关)→
「编程与Agent」频道最新
- 用 Agent 造小分类器:19 万文档标注成本仅 0.7 美元 — vanstriendaniel · 2026-09-11
- MathModelAgent 走红:自动完成数学建模并生成可提交论文 — jihe520 · 2026-09-11
- alphaXiv 开源 OpenResearch:用任意模型并行跑研究智能体 — alphaXiv · 2026-09-11
- 开源 AI 销售 OS DeskcommCRM 爆火:自带 Agent 与 WhatsApp 集成 — melgarafael · 2026-09-11
- hyperresearch 开源:让 Agent 把网络调研沉淀为可搜索知识库 — jordan-gibbs · 2026-09-11
- Forter 两周全员 Agent 冲刺 13 条经验:跳过自建 RAG 靠企业搜索 — bibryam · 2026-09-11