实测 Meta 新模型 Muse Glimmer 30B:Mac Studio 本地跑出 30 tok/s
MaziyarPanahi · x · 2026-08-10
开发者在 Mac Studio 上成功本地运行了 Meta 最新发布的 Muse Glimmer 30B 多模态模型(GGUF 格式)。
实测视频展示了真实的两轮对话过程:模型能够实时输出推理流,随后给出最终答案,本地 API 实测速度约为 30 tokens/秒。作者表示,目前正在将该本地技术栈应用于医疗工作流、视觉管线、工具调用以及完整的智能体任务测试中。
所属事件:Meta新模型Muse Glimmer 30B获Llama.cpp零日支持并成功本地跑通(2 条相关)→
「模型」频道最新
- Muse Glimmer 开源:专为智能体场景优化的 30B 稠密模型 — JesseDodge · 2026-08-10
- 单卡 RTX 5060 Ti 跑 30B 模型,实现 13 万上下文 — BazzyIm · 2026-08-10
- 拓扑学实测:Grok 想象 2.0 击败 ChatGPT 正确理解亏格 — luismbat · 2026-08-10
- 用日食概率题测试大模型,推理路径差异显著 — Afinetheorem · 2026-08-10
- OpenAI 封锁 Astra 模型:首次触发严重网络安全能力警报 — sksarkpoes3 · 2026-08-10
- 观点:Google 缺乏顶尖编程模型,或应跳过 3.5 直发 Gemini 4 — haider1 · 2026-08-10