放弃再买 5090:本地推理用户改投 Spark,省心还能跑更大模型

ideamaker321 · reddit · 2026-09-15

一位本地部署爱好者原计划再买一张 RTX 5090,最终决定改买两台 Spark。5090 训练小模型确实快,但推理端跑 Qwen3.8 27B 需要持续调优、压缩问题不断,无法「设好就不管」;而现有的两台 Spark 跑 Qwen Flash Next 稳定省心,再加两台后即可运行更大的 DSF v4.1。作者在 r/LocalLLaMA 征询其他人对 5090 推理体验的看法。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →