SemiAnalysis:Rubin 搭 vLLM 每吉瓦利润较 GB300 NVL72 高 3.2 倍
woosuk_k · x · 2026-10-10
- SemiAnalysis 发布分析称,NVIDIA 下一代 Rubin 平台在生产级推理引擎 vLLM 上的表现远超现有旗舰:每吉瓦利润提升 3.2 倍,每美元性能最高提升 10 倍(对比 GB300 NVL72)。
- 该测试基于广泛使用的生产 LLM 推理引擎 vLLM,即结论贴近真实部署场景而非厂商自选 benchmark。
- 这意味着 Rubin 若如期落地,在算力紧张、电费主导成本的推理市场上可能大幅改变单位算力经济账。细节在 SemiAnalysis 的三段式线程中展开。
「Infra」频道最新
- SGLang-Diffusion 扩散模型推理框架将亮相 PyTorch 大会 — PyTorch · 2026-10-10
- 吴恩达:我的一个 agent 一天发起 5000–10000 次网页搜索,数据中心远远不够 — DeepLearningAI · 2026-10-10
- SGLang Summit 2026 议程公布:Intel/OpenAI/Perplexity 高管齐聚 SF — ying11231 · 2026-10-10
- AI 推理市场明年或从 1600 亿增至 3500 亿美元,软件毛利将承压 — Sethwinterroth · 2026-10-10
- Nebius 净债务仅 0.2 倍营收,远优于 CoreWeave 的 2.9 倍 — Beth_Kindig · 2026-10-10
- Devon Eriksen 用「一罐重元素」类比讲解先进芯片制造的资源门槛 — Yamapama · 2026-10-10