Muse Glimmer 30B 模型获 Llama.cpp 零日支持,Mac Studio 本地跑通

MaziyarPanahi · x · 2026-08-10

开发者感谢 Hugging Face 和 UnslothAI 为 Meta 新发布的 Muse Glimmer 30B 模型提供了零日(首发)支持,使其能通过 Llama.cpp 和 GGUF 格式在本地运行。

作者已在 Mac Studio 上成功实现本地部署,实测推理速度约为 30 tokens/s,并展示了 API 返回的推理流实时折叠效果。目前正进一步测试该本地栈在医疗工作流、视觉流水线和智能体任务中的表现。

所属事件:Meta新模型Muse Glimmer 30B获Llama.cpp零日支持并成功本地跑通(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →