Muse Glimmer 30B模型实现浏览器原生级推理速度
nicodotdev · x · 2026-08-12
Meta 发布的新模型 Muse Glimmer 30B 现已支持通过 WebGPU 在浏览器本地运行。实测显示,其在 M4 Max 处理器上能达到约 25 tok/s 的速度,与使用 llama.cpp 的原生运行速度相当,且无需安装任何额外软件。
所属事件:M4 Max芯片跑30B模型达25 tok/s,WebGPU立功(2 条相关)→
「模型」频道最新
- 主流大模型暴露推理轨迹,防蒸馏措施引关注 — jessi_cata · 2026-08-12
- LangChain 创始人吐槽模型选择:太接近,无法判断 — hwchase17 · 2026-08-12
- Opus 5 被讨厌?网友支招:用简化技术英语提示 — daniel_mac8 · 2026-08-12
- OpenAI 核心研究员:Token 成本还会大幅下降 — morqon · 2026-08-12
- 曝 OpenAI 与 Anthropic 内部模型进展惊人:破解数学难题与突破黎曼假设 — haider1 · 2026-08-12
- 曝 Anthropic 模型思维链可被提取,跨模型越狱攻击生效 — jessi_cata · 2026-08-12