Meta 发布 Muse Glimmer:30B 开源端侧智能体模型,24GB 显存即可跑
alexandr_wang · x · 2026-08-10
Meta 超级智能实验室发布 Muse Glimmer,这是一个拥有 300 亿参数的开源智能体模型,权重采用 Apache 2.0 协议。
- 端侧运行:专为本地全天候智能体工作流优化,可在单张消费级 GPU(24GB 显存)上运行,支持本地编码、函数调用和 LLM-as-a-judge 评估。
- 推理优化:采用自研架构与配方,通过 4-bit 量化将模型体积压至 20GB 以内,并引入 dflash 投射器机制进行并行 Token 验证,以保持响应速度。
- 智能体能力:具备规划、工具调用、结果自检和故障恢复等完整智能体能力,表现不逊于更大的模型。
- 生态支持:模型权重已上线 Hugging Face,本周内将陆续支持 Ollama、vLLM、llama.cpp 等主流推理工具。
此外,另一个模型 Muse Spark 1.2 的开源版本也即将发布。
所属事件:Meta开源30B智能体模型Muse Glimmer,单卡即可运行(30 条相关)→
「Infra」频道最新
- llama.cpp首发支持Muse Glimmer模型 — jacek2023 · 2026-08-10
- 英特尔拟发行150亿美元股票,押注AI算力需求 — ryanshrout · 2026-08-10
- 云端大模型+本地小模型混合架构潜力大,Muse Spark 1.2即将开源 — jack_w_rae · 2026-08-10
- 实测 30B 模型跑出 114 tps,优化后有望在 16G 显存运行 — tokenbender · 2026-08-10
- DeepSeek API日耗仅1.14美元,自购双DGX回本需24年 — delduca · 2026-08-10
- 算力之后的新瓶颈:AI 数据中心面临电力短缺挑战 — ingliguori · 2026-08-10