实测 Meta 新模型 Muse Glimmer 30B:Mac Studio 本地跑出 30 tok/s

MaziyarPanahi · x · 2026-08-10

开发者在 Mac Studio 上成功本地运行了 Meta 最新发布的 Muse Glimmer 30B 多模态模型(GGUF 格式)。

实测视频展示了真实的两轮对话过程:模型能够实时输出推理流,随后给出最终答案,本地 API 实测速度约为 30 tokens/秒。作者表示,目前正在将该本地技术栈应用于医疗工作流、视觉管线、工具调用以及完整的智能体任务测试中。

所属事件:Meta新模型Muse Glimmer 30B获Llama.cpp零日支持并成功本地跑通(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →