本地跑 Qwen 35B:32GB Mac 提示词处理慢至 20 分钟求升级方案

Guilty-Support-584 · reddit · 2026-09-16

Reddit 用户咨询本地部署硬件选型:现有 M2 Max 32GB MacBook 跑 Qwen3.6 35B A3B(q4,18GB)+60k 上下文明显吃力,会触发 swap;纯 SSD 流式仅 4-10 tks;全载入 RAM 后 15-20 tks,但 40-60k token 的 prompt 处理仍需 20-60 分钟。候选方案为 €1500 二手 M1 Max 64GB、€3500 M3 Max 128GB,或自组 24GB 显卡 + 128GB RAM 的 PC。目标是在合理价位以可用速度跑最强本地模型,评论在讨论各方案能跑的模型规格与预期速度。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →