4000 美元预算如何本地跑 Qwen 3.8 Next 对标 Opus

ironicstatistic · reddit · 2026-09-17

一位 Reddit 用户征求部署建议,目标是花尽量少的钱(上限 $4000)搭一台双 GPU 服务器,本地运行 Qwen 3.8 Next 的 Q3 量化版(含 KV 缓存约 85GB),以 256k 上下文达到对标 Claude Opus 的智能水平,目标性能约 500 tok/s 预填充、20 tok/s 解码。

他列出了四套方案:

作者判断:随 n-gram 投机解码等优化成熟,中端 Opus 级模型将成为个人可负担本地部署的主流目标。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →