双 3090 用户算账:升级 176GB 显存跑新开源模型值不值 7000 美元

eribob · reddit · 2026-09-27

一位本地部署玩家在双 RTX 3090(fp8 量化、129k 上下文)上跑 Qwen 3.8 27B,纠结是否要为新出的 Qwen 3.8 Flash、DeepSeek V4 Flash、GLM 5.3 Flash 等更大 MoE 模型升级硬件。他算了一笔账:

他在问:花这个钱能否换来「明显更聪明」的体验,以及 MoE 是否真能更快。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →