Mac Studio浏览器跑30B大模型达32 tok/s,本地AI性能惊艳

MaziyarPanahi · x · 2026-08-12

开发者实测在 Mac Studio 上完全通过 Chrome 浏览器加载 30B 参数的稠密模型(Muse Glimmer),运行医疗 AI 流水线(包括隐私信息检测、临床实体识别和关系抽取)时,推理速度达到了约 32 tokens/秒。这一实测数据展现了当前端侧和本地 AI 部署能力的显著进步。作者预告晚些时候还会带来 Qwen3.8 27B 的类似测试。

所属事件:Muse Glimmer 30B实测:端侧多模态智能体新标杆(14 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →