8张 V100 能否支撑 50 人团队的 DeepSeek 本地推理?
MKU64 · reddit · 2026-08-06
开发者在 Reddit 论坛提问,询问由 8 张 NVIDIA V100 (32GB) 组成的算力集群,是否足以支撑 30-50 名团队成员日常使用 DeepSeek V4 Flash 模型。该讨论涉及企业级大模型私有化部署的并发处理能力与硬件选型评估。
「Infra」频道最新
- 单台 Spark 硬件跑 DeepSeek V4,本地推理速度达 95 tok/s — Rasmic · 2026-08-06
- 本地部署进阶:一台机器混用N卡和A卡跑不同大模型 — Curious-Pen5547 · 2026-08-06
- Luminal 编译器探索极速 Megakernels,突破带宽与算力极限 — AccBalanced · 2026-08-06
- Mac 本地大模型选型指南:16G 内存也能跑 27B 模型 — JosephJacks_ · 2026-08-06
- 不到10GB显存跑276B大模型!Mference实测近3 tok/s — Blahblahblakha · 2026-08-06
- RTX 3090 实测:INT8 量化让 MiniMax 视频生成提速翻倍 — Nevaditew · 2026-08-06