Mac Mini 跑出 200+ tokens/s,DeepGrove 发布端侧推理新模型
ycombinator · x · 2026-08-05
DeepGrove 发布了开源的 Maple-Preview 模型,这是一个 20B 参数(激活 1B)的三值权重推理大语言模型。
据称该模型在其权重类别中达到了 SOTA 水平,能够解决 IMO(国际数学奥林匹克)级别的问题。最引人注目的是,它可以在 Mac Mini M4 上以每秒 200+ tokens 的速度运行,比 Gemma 4、Qwen3.5 等同级别高效模型快 5 到 16 倍,向设备上的个人智能体迈出了重要一步。
所属事件:DeepGrove发布Maple模型,Mac Mini端侧推理破200 tokens/s(2 条相关)→
「Infra」频道最新
- 车库太阳能供电:384GB至强主机远程跑AI编程 — angadsg · 2026-08-05
- AMD CEO 苏姿丰电话会霸气放话:分析师的 AI 数据中心预期太低了 — firstadopter · 2026-08-05
- 单卡 RTX 5090 跑 27B 本地 Agent,开源全栈部署方案 — max_paperclips · 2026-08-05
- 欧洲 AI 超级工厂承诺 300 亿欧元,实际仅落实 10 亿 — sanjaykalra · 2026-08-05
- Modal 优化 Serverless 架构:大幅降低网络路由延迟 — AAAzzam · 2026-08-05
- 马斯克:AI内存需求年增超200%,算力瓶颈在内存 — firstadopter · 2026-08-05