Mac Studio 浏览器跑 30B 模型达 32 tok/s,本地 AI 推理实测惊艳
MaziyarPanahi · x · 2026-08-12
开发者实测在 Mac Studio 上的 Chrome 浏览器中完全加载了 30B 参数的稠密模型 Muse Glimmer,并实现了约 32 tokens/s 的生成速度。
该测试在本地成功运行了一套临床 AI 流水线,涵盖 PII 检测、临床命名实体识别(NER)以及关系抽取等任务。这一表现展示了端侧和本地 AI 推理技术的巨大进步。
所属事件:Meta开源Muse Glimmer 30B:端侧智能体实测惊艳(14 条相关)→
「Infra」频道最新
- 推理非投机:Token 消费不同于泡沫期硬件囤积 — AccBalanced · 2026-08-26
- 高通 Oryon CPU 跑 5GHz,FlexCache 助力 Agent — davemccollough · 2026-08-26
- 买本地跑模型的机器前,先问 AI 你的具体需求 — cocktailpeanut · 2026-08-26
- 配置变更导致 17% 进程崩溃,重试浪涌引发连锁事故 — techNmak · 2026-08-26
- 遥测服务致 K8s 控制平面过载,OpenAI 全线宕机复盘 — techNmak · 2026-08-26
- 17%会话进程瞬间掉线引发级联故障,Discord宕机复盘 — techNmak · 2026-08-26