双卡 3090 够用吗?本地 LLM 玩家讨论是否再堆两张
Blues520 · reddit · 2026-09-04
一位跑双 RTX 3090(48GB 显存)的本地模型用户发帖求助:目前跑 Qwen 27B 级模型流畅,是否值得再加两张 3090 到 96GB。社区讨论的取舍在于:堆卡跑更大模型(如新出的 Qwen Flash、DeepSeek 系量化版),还是跑双实例并行提升编码工作流吞吐。
帖子汇集了多卡 3090 机架玩家的经验,是消费级本地部署性价比讨论的典型样本:老卡二手价低,但功耗与多卡互联效率是主要代价。
「Infra」频道最新
- 单台 DGX Spark 跑 Qwen3.8 Flash NVFP4:1M 上下文实测方案 — BLUECOW009 · 2026-09-04
- Taalas 把 Llama 3.1 8B 烧进定制芯片,实测每秒 15000 tokens — npew · 2026-09-04
- 14.6 万请求实测:OpenRouter 端点 13 天内 44 个频繁宕机又恢复 — ringarc · 2026-09-04
- 花 1.8 万欧自建 768GB 显存服务器,却追不上 2 万亿参数开源模型 — myreala · 2026-09-04
- DeepSeek 拟在内蒙古部署 16 万颗华为昇腾芯片,创最大集群纪录 — The Decoder · 2026-09-04
- Kafka 精确一次交付三层机制解析:出 Kafka 即裸奔 — arpit_bhayani · 2026-09-04