16 万元 RTX Pro 6000 闲置换 M5 Max 128GB?本地推理选型讨论

aghanims-scepter · reddit · 2026-08-20

Reddit 求助帖:作者有一台 9950x3D + 256GB RAM + RTX Pro 6000(降压 350W)的本地 AI 服务器,但工作已是全天 AI 编码,下班只做非编码类本地推理(健康/财务等隐私数据、heretic 模型),不追求低延迟。考虑卖掉如今 MSRP 高达 1.6 万美元的显卡,换成 M5 Max 128GB MacBook Pro 一机两用,免去服务器常开与远程访问麻烦。

核心问题:M5 Max 跑 Qwen3.6/3.8、Gemma4 等稠密模型长上下文体验如何?14 寸长时推理会不会过热降频?以及如何安全出手 RTX 6000。社区讨论 M4 时代 Mac 推理速度(pp/ttft)曾被诟病,M5 是否改善是关键。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →