Kimi K3 据称跑在 80 张 RTX 5090 上,合计 2.56TB 显存
sandyyevans · reddit · 2026-07-28
宁团队据称把 Kimi K3 部署在 80 张 RTX 5090 上做本地推理,整体为 10 台节点、每台 8 卡,合计 2.56TB 显存。
- 目前用的是 FP4 权重。
- 方案里没有 HBM、NVLink、InfiniBand,主要靠 5090 的 GDDR7 和 25GbE 网络。
- 单路推理速度约 20 tok/s,团队也承认还没怎么优化。
原帖认为这套配置带有一定“宣传秀”色彩,但也说明一个趋势:随着 GPU 性能继续演进,过去看起来离谱的本地大模型部署,可能在一两年内变得相当现实。
所属事件:Kimi K3 跑通 80 张 RTX 5090 集群(5 条相关)→
「Infra」频道最新
- x402 正成 Agentic AI 工具的按次付费通道 — kleffew94 · 2026-07-28
- Moonshot 被曝用 Nvidia Blackwell 训练 Kimi K3 — RebeccaBellan · 2026-07-28
- KLA 电话会更该看 AI 需求信号 — tengyanAI · 2026-07-28
- 摩根士丹利估算 GPU 租赁业务可达 70% 增量利润率 — firstadopter · 2026-07-28
- Ben Bajarin:算力需求仍强,资本却转向谨慎 — BenBajarin · 2026-07-28
- TensorLib 用纯 C 实现深度学习库,在 CPU 上训练小语言模型 — Intelligent_Nose_791 · 2026-07-28