16 万元 RTX Pro 6000 闲置换 M5 Max 128GB?本地推理选型讨论
aghanims-scepter · reddit · 2026-08-20
Reddit 求助帖:作者有一台 9950x3D + 256GB RAM + RTX Pro 6000(降压 350W)的本地 AI 服务器,但工作已是全天 AI 编码,下班只做非编码类本地推理(健康/财务等隐私数据、heretic 模型),不追求低延迟。考虑卖掉如今 MSRP 高达 1.6 万美元的显卡,换成 M5 Max 128GB MacBook Pro 一机两用,免去服务器常开与远程访问麻烦。
核心问题:M5 Max 跑 Qwen3.6/3.8、Gemma4 等稠密模型长上下文体验如何?14 寸长时推理会不会过热降频?以及如何安全出手 RTX 6000。社区讨论 M4 时代 Mac 推理速度(pp/ttft)曾被诟病,M5 是否改善是关键。
「Infra」频道最新
- 开发者计费指南:按 Token 付费或比订阅更划算 — heypearlai · 2026-08-20
- Tailscale 复盘:耗时数月追踪 SQLite 16 年陈年 Bug — JeremyCMorgan · 2026-08-20
- Qwen 3.8 27B 跑出 70t/s:参数配置全公开 — dsdt · 2026-08-20
- AI 模型网关 OpenRouter 加入 Stripe — handotdev · 2026-08-20
- 浏览器运行模型的手势识别 Demo,用 Weave 追踪其错误 — wandb · 2026-08-20
- GPU 虚拟化初创融资 1300 万美元,旨在释放 80% 算力闲置 — charlieholtz · 2026-08-20