CoreWeave 点亮多机柜 Vera Rubin NVL72 集群并公开工程细节
OnlineInference · x · 2026-09-17
CoreWeave 宣布部署多机柜 NVIDIA Vera Rubin NVL72 集群:单个机柜含 72 块 Rubin GPU、36 颗 Vera CPU、NVLink 6 互联、45°C 液冷;多机柜互联后数百块 GPU 构成统一 scale-out 系统,面向训练、推理与 agentic AI 负载。博客详述多机柜带来的工程挑战:GPU 慢节点会拖累全局、网络链路波动影响集合通信、液冷异常导致降频,以及固件与配置一致性问题。CoreWeave 此前已率先上线 L40S、H200、GB200/GB300 NVL72 等多代 GPU。
所属事件:CoreWeave 部署多机柜 NVIDIA Vera Rubin NVL72 集群(2 条相关)→
「Infra」频道最新
- llama.cpp 跑 Qwen3.8-Flash-Next 的 SSD N-gram 流式参数求助 — Ambitious_Fold_2874 · 2026-09-17
- 贝尔实验室如何错失微芯片:IEEE Spectrum 复盘一段技术史教训 — ArtificialOther · 2026-09-17
- RCR 研报:AI Agent 将成网络基础设施的下一类"用户" — seankinneyRCR · 2026-09-17
- B200现货租金八个月涨80%,算力需求跑赢供给扩张 — JOBhakdi · 2026-09-17
- MLX-Serve 新版发布:M4/M5 Max 上 Qwen Flash 跑出 100+ tok/s — TheMoonMidas · 2026-09-17
- 16GB 内存硬跑 14B 模型,网友自嘲把电脑跑成了面包机 — Aggravating_Site381 · 2026-09-17