Meta发布开源30B本地Agent模型Muse Glimmer
hsu_byron · x · 2026-08-10
Meta 正式发布了 Muse Glimmer,这是一款拥有 300 亿参数的稠密模型,专为本地、常驻运行的 Agent 工作流优化。模型采用完全开源权重(Apache 2.0 许可证),旨在 Mac 或高性能 PC 等消费级硬件上独立运行,在关键智能体用例上表现出色。
LMSYS 随即分享了该模型的实测数据:在 SGLang 的支持下,Muse Glimmer 在单张 RTX 5090 显卡上开启了 NVFP4 + DFlash 后,推理速度可达约 230 tokens/s。该模型开箱即用支持 NVIDIA RTX Pro 6000、DGX Spark 以及 Mac 端的 MLX 框架。这种极速且可靠的本地推理能力,扫清了以往阻碍本地 Agent 发展的速度障碍。
所属事件:Meta 发布 30B 开源模型 Muse Glimmer,主打端侧智能体(30 条相关)→
「Infra」频道最新
- llama.cpp首发支持Muse Glimmer模型 — jacek2023 · 2026-08-10
- 英特尔拟发行150亿美元股票,押注AI算力需求 — ryanshrout · 2026-08-10
- 云端大模型+本地小模型混合架构潜力大,Muse Spark 1.2即将开源 — jack_w_rae · 2026-08-10
- 实测 30B 模型跑出 114 tps,优化后有望在 16G 显存运行 — tokenbender · 2026-08-10
- DeepSeek API日耗仅1.14美元,自购双DGX回本需24年 — delduca · 2026-08-10
- 算力之后的新瓶颈:AI 数据中心面临电力短缺挑战 — ingliguori · 2026-08-10