双 3090+老 EPYC 跑 177B MoE 模型:38 tok/s 仅花 800 美元

ludos1978 · reddit · 2026-09-13

楼主分享了本地运行 Qwen3-Flash-Next(177B 总参数/6B 激活 MoE,IQ4XS 量化)的硬件方案与实测数据:

楼主还有 $800 预算,纠结是加第三张 3090 还是升级 Zen2 EPYC(同插槽可换),并求证加内存/更快内存的实际收益,目标是多 agent 并行时保住速度。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →