M3 Ultra 跑 27B 模型性能提升 45%,实测 CPU+GPU+ANE 协同
AIFlow_ML · x · 2026-08-20
开发者实测在 M3 Ultra 上利用 3 个 CPU 核心、GPU 和 ANE (神经网络引擎) 协同运行 27B 模型,相比纯 GPU 方案实现了净增 45.8% 的性能提升,达到了约 517.9 PP tok/s。此外,新版调优器能在几分钟内(而非 10 多分钟)平衡 5 个维度的负载,大幅提升了优化效率。
「Infra」频道最新
- 第四代低温恒温器亮相,集成 250+ 光子芯片 — jwt0625 · 2026-08-20
- 铜缆以太网成本极低:每Gbps仅需0.1-0.25美元 — jwt0625 · 2026-08-20
- Nvidia 实际算力受供电限制,广告宣传需细看 — nabla_theta · 2026-08-20
- ML 研究员:算力匮乏而非想法拖慢了研究进度 — A_K_Nain · 2026-08-20
- 重启 llama.cpp 导致长对话预填慢?建议实现 KV 状态自动存盘 — Dazzling_Equipment_9 · 2026-08-20
- YC 新项目 Atomarine:把数据中心搬到海上解决算力瓶颈 — ycombinator · 2026-08-20