1.5 万美元预算选卡:跑 DeepSeek V4 Flash 至少要 128GB 显存
_TheWolfOfWalmart_ · reddit · 2026-09-12
一位 Reddit 用户为公司采购本地推理硬件求助:预算约 1.5 万美元,要求在 Dell R740 内以不超过 3 张卡本地运行 DSV4 Flash 等大模型,至少 128GB 显存且避免重度量化,兼顾 token 生成与 prompt 处理速度,支持 1-3 人并发。候选方案为 3× AMD MI210(192GB)或 3× NVIDIA A40(144GB),发帖人希望了解这两组卡在实际运行 DSV4 Flash、Qwen3.8-Flash-Next 等模型时的性能数据,并称云端租不到同款卡做测试。
「Infra」频道最新
- 分析师估算:Instinct 类应用每年或烧掉上亿美元 token 成本 — ivan_bezdomny · 2026-09-12
- Instinct 日常算力成本几何?OpenRouter 视角的估算讨论 — ivan_bezdomny · 2026-09-12
- 17B 模型从 SSD 跑起:单核 33 tokens/s,无 GPU 训练 — Just_Vugg_PolyMCP · 2026-09-12
- LMStudio 支持 llama.cpp 参数覆盖,yarn-attn-factor 1.2 或提升创意 — Extraaltodeus · 2026-09-12
- 分析师披露 Apple S11、A20、M6 芯片新封装与端侧 AI 设计细节 — BenBajarin · 2026-09-12
- Ben Bajarin 报告:定制芯片转向程序责任之争,Agentic AI 进军网络防御 — BenBajarin · 2026-09-12