Muse Glimmer 30B 模型获 Llama.cpp 零日支持,Mac Studio 本地跑通
MaziyarPanahi · x · 2026-08-10
开发者感谢 Hugging Face 和 UnslothAI 为 Meta 新发布的 Muse Glimmer 30B 模型提供了零日(首发)支持,使其能通过 Llama.cpp 和 GGUF 格式在本地运行。
作者已在 Mac Studio 上成功实现本地部署,实测推理速度约为 30 tokens/s,并展示了 API 返回的推理流实时折叠效果。目前正进一步测试该本地栈在医疗工作流、视觉流水线和智能体任务中的表现。
所属事件:Meta新模型Muse Glimmer 30B获Llama.cpp零日支持并成功本地跑通(2 条相关)→
「Infra」频道最新
- 告别摘要压缩:densely 实现无损 LLM 上下文压缩,最高省 87% Token — No_Advertising2536 · 2026-08-10
- 2-bit量化版Muse Glimmer在14GB内存实现百次工具调用 — danielhanchen · 2026-08-10
- 单卡跑满 256k 上下文:实测 Muse Glimmer 30B 本地部署显存与性能 — coder543 · 2026-08-10
- 黑石总裁将出席峰会,谈AI投资与数据中心布局 — GavinSBaker · 2026-08-10
- 营收增108%但增速放缓,寒武纪面临供应与竞争压力 — pstAsiatech · 2026-08-10
- 曝微软将推自研芯片Maia 300:单美元性能提升超30% — rohanpaul_ai · 2026-08-10