Mac Studio浏览器跑30B大模型达32 tok/s,本地AI性能惊艳
MaziyarPanahi · x · 2026-08-12
开发者实测在 Mac Studio 上完全通过 Chrome 浏览器加载 30B 参数的稠密模型(Muse Glimmer),运行医疗 AI 流水线(包括隐私信息检测、临床实体识别和关系抽取)时,推理速度达到了约 32 tokens/秒。这一实测数据展现了当前端侧和本地 AI 部署能力的显著进步。作者预告晚些时候还会带来 Qwen3.8 27B 的类似测试。
所属事件:Muse Glimmer 30B实测:端侧多模态智能体新标杆(14 条相关)→
「Infra」频道最新
- 分析师预计2030年服务器CPU市场达2200亿美元 — BenBajarin · 2026-08-12
- Hugging Face 模型下载量骤降约 30%,疑因平台过滤机制调整 — natolambert · 2026-08-12
- HuggingFace 模型日均下载量骤降约 30%,疑因平台过滤机制调整 — natolambert · 2026-08-12
- 大空头 Burry 炮轰英伟达:500 亿芯片融资是华尔街包装的垃圾债 — GaryMarcus · 2026-08-12
- Wintermute 计划五年内豪掷 10 亿美元押注 AI 算力 — abhiadesai · 2026-08-12
- 71% 美国人反对家附近建数据中心,比例超核电站 — PeterDiamandis · 2026-08-12