放弃再买 5090:本地推理用户改投 Spark,省心还能跑更大模型
ideamaker321 · reddit · 2026-09-15
一位本地部署爱好者原计划再买一张 RTX 5090,最终决定改买两台 Spark。5090 训练小模型确实快,但推理端跑 Qwen3.8 27B 需要持续调优、压缩问题不断,无法「设好就不管」;而现有的两台 Spark 跑 Qwen Flash Next 稳定省心,再加两台后即可运行更大的 DSF v4.1。作者在 r/LocalLLaMA 征询其他人对 5090 推理体验的看法。
「Infra」频道最新
- 前 OpenAI 高管 Liam Fedus 打造「Neon」:1300 块 H200 训出超导实验分析模型 — vwxyzjn · 2026-09-16
- Periodic Labs:1300 张 H200 训出 Pareto 压制前沿模型的科学模型 — zephyr_z9 · 2026-09-16
- NVIDIA 携手 Palantir 押注主权 AI:供应链与算力本土化开跑 — postalex · 2026-09-16
- 分析师看好 Credo:光子芯片整合或被市场低估 — BenBajarin · 2026-09-16
- Naveen Rao 展示模拟振荡器存权重芯片,宣称两年内能效超英伟达千倍 — PTrubey · 2026-09-16
- 三台旧设备拼内存跑 40B 模型:16 tok/s,还发现 CPU 争用反常识结论 — Medicine_Blogscanner · 2026-09-16