Meta 开源端侧 30B 智能体模型,闭源旗舰+开源蒸馏双线并行
eyishazyer · x · 2026-08-10
Meta 发布了 30B 参数的本地智能体模型 Muse Glimmer。作者指出,这并非简单的“开源回归”,而是 Meta 采取的新策略:保持闭源旗舰模型专有以实现商业化,同时开源由其蒸馏而来的压缩版本,以此兼顾商业变现与开源生态建设。
核心技术与应用亮点:
- 端侧运行:通过约 4-bit 量化将显存占用压至 20GB 以下,配合 DFlash 推测解码技术,在 RTX 5090 上实现 3.1 倍解码加速,且声称无质量损失。
- 专注智能体:模型专为完整任务执行、工具调用、多步推理和故障恢复微调,需深度访问个人上下文(如日程、文件),完全本地运行消除了云端隐私顾虑。
所属事件:Meta 发布开源 30B 模型 Muse Glimmer,主打端侧智能体(25 条相关)→
「编程与Agent」频道最新
- Ollama 详解 Muse Glimmer 本地部署:支持 128K 上下文与可控推理 — mchiang0610 · 2026-08-10
- Meta 发布 Muse Glimmer:支持本地运行的开源 30B 智能体模型 — mchiang0610 · 2026-08-10
- 告别 print():开源本地 AI Agent 调试工具 — No_Firefighter8428 · 2026-08-10
- LifeOS:基于爬山算法的通用 AI 框架 — danielmiessler · 2026-08-10
- 生产环境中如何精准核算单次 Agent 运行成本? — Efficient_Wave_806 · 2026-08-10
- AI 编程时代:代码审查反而证明了开源的生命力 — MarcJSchmidt · 2026-08-10