为静音全程低功耗跑 M5 Max:128GB 本地跑 Qwen 的取舍实录
joshwhiton · x · 2026-09-19
作者买了 M5 Max MacBook 后一直开着低功耗模式运行,用更慢的 token/s 换取全程无风扇静音;同时表示 128GB 统一内存对本地运行 Qwen 模型依然充裕。一个本地部署场景下性能与噪音权衡的真实样本。
「Infra」频道最新
- 16GB 显存实测:Qwen 27B IQ3 量化比 Bonsai 三元模型快 3 倍 — Danmoreng · 2026-09-19
- Meta Muse 免费送每人一台服务器?云专家拆解 Firecracker 微 VM 成本账 — carlosdponx · 2026-09-19
- mitsuhiko:租千卡跑模型也要自建机房才有戏 — mitsuhiko · 2026-09-19
- 开发者爆料:宣称99%缓存率的推理服务商很可能是套壳DeepSeek — TheZachMueller · 2026-09-19
- thdxr 解析 DeepSeek 高缓存命中率:千项细节优化堆出来的护城河 — thdxr · 2026-09-19
- Meta 工程师拆解大规模分布式推理:推理需要自己的控制平面 — AI Engineer · 2026-09-19