Mac本地跑大模型:M2 Ultra 192G长文本推理实测
Badger-Purple · reddit · 2026-08-02
一名开发者在搭载 192GB 内存的 M2 Ultra 电脑上,实测了本地运行大模型(Deepseek-V4-Flash-0731 Dwarfstar)的推理性能。
性能数据:
- Prefill(预填充)阶段:性能强劲(见配图图表)
- Decode(解码)阶段:起始速度为 28 t/s;上下文长度达 45k 时降至 25 t/s;达到极限 192k 时仍有 17 t/s。
「Infra」频道最新
- 为何 SQLite 架构将在 AI Agent 时代占据主导? — glcst · 2026-08-03
- SK海力士营收超台积电引热议:存储芯片繁荣背后的隐忧 — jwt0625 · 2026-08-03
- M3 Ultra 跑 DeepSeek V4 速度达 37 t/s — mishig25 · 2026-08-03
- Cloudflare 启动 Agents Week:打造面向 AI 智能体的专属云原生底座 — ritakozlov · 2026-08-03
- 开源视频模型部署避坑:商用授权与显存需求实测对比 — Mysterious_Sign_9501 · 2026-08-03
- AMD与Core Scientific签530MW AI数据中心协议,价值超140亿美元 — Beth_Kindig · 2026-08-03