M5 Ultra 本地跑大模型实测:预填充快 4 倍,但功耗翻倍
DigitalguyCH · reddit · 2026-09-23
Reddit 用户发布了 Apple M5 Ultra 运行大模型的初步实测(视频见原文链接):
- Prompt processing 速度:比 M3 Ultra 快 4 到 4.5 倍(视上下文长度而定)
- 生成速度:tok/s 约为 M3 Ultra 的 1.5 倍
- 代价:整机功耗翻倍(400W vs 200W),风扇噪音更大,机身温度明显更高
结论是性能提升显著,但能效比反而退步,追求本地部署安静低温体验的用户需要权衡。
「具身」频道最新
- 小鹏 IRON 新演示:9 麦克风阵列+唇动识别实现全双工对话 — ChrisGPT · 2026-09-23
- Uber×Waymo 扩展:奥斯汀用户可在高速路段体验无人车 — ATTlKA · 2026-09-23
- Figure CEO:人形机器人分四阶段,最终需数百亿美元投入 — adcock_brett · 2026-09-23
- InstinctFlash 开源运行时:单张商用 GPU 实时跑 8 系列机器人通用模型 — chris_j_paxton · 2026-09-23
- M5 Ultra 96GB vs RTX 5090/6000 Pro:视频生成装机怎么选 — MaxwellHusk · 2026-09-23
- 拆解大疆 Mini 无人机:139 美元物料成本,毛利高达 79% — rbhar90 · 2026-09-23