英伟达发布 Vera Rubin 平台,能效提升 10 倍
英伟达正式发布并上线了 Vera Rubin 平台,该平台主要面向 Agentic(智能体)时代,旨在通过大幅提升算力效率来削减大规模 AI 模型的推理成本。目前,Vera Rubin NVL72 正由 CoreWeave、Google Cloud 和 Microsoft 等全球合作伙伴推进。
已确认
英伟达官方宣称,Vera Rubin 带来了 10 倍更好的每瓦性能。据 CoreWeave 拿到的首批实测性能数据,在运行 DeepSeek-R1 模型时,Vera Rubin NVL72 相比现有的 Blackwell 架构(如 GB200),能够实现每兆瓦多出 10 倍的 Token 生成量。此外,英伟达高管 Kyle Kranen 还透露了下一代 Rubin 架构的设计目标,即最大化“每瓦智能体 Token 生成量”。在核心硬件规格方面,该架构的算力目标为 50 Petaflops,并将配备带宽高达 22TB/s 的 HBM4 内存。
为什么重要
随着 AI 模型规模扩大与智能体应用的普及,推理阶段的算力与能耗成本成为核心瓶颈。Vera Rubin 通过将每瓦性能提升 10 倍,有望大幅降低大规模 AI 的运算成本,并推动高能效基础设施的进一步普及。
2026-07-21 ~ 2026-07-23 · 6 条相关
- 第 1 集:NVIDIA交付102.4Tbps Spectrum-6交换机(2026-07-21,3 条)
- 第 2 集:英伟达发布 Vera Rubin 平台,能效提升 10 倍(2026-07-21,6 条)
- 第 3 集:英伟达提前披露 Vera CPU 细节(2026-07-22,8 条)
- 第 4 集:NVIDIA Vera Rubin NVL72机架在芬兰实拍曝光(2026-07-23,2 条)
一手来源
- NVIDIA 发布 Vera Rubin,称每瓦性能提升 10 倍 — nvidia ·
- NVIDIA 称 Vera Rubin NVL72 比 Blackwell 每兆瓦多出 10 倍 token — nvidia ·
- 英伟达 Rubin 架构曝光:HBM4 内存带宽达 22TB/s — charles_irl ·
- 英伟达发布Vera Rubin,主打极致能效与最低Token成本 — nordicinst · 2026-07-21
- 【源头】NVIDIA 称 Vera Rubin NVL72 比 Blackwell 每兆瓦多出 10 倍 token — nvidia · 2026-07-22
- 【源头】NVIDIA 发布 Vera Rubin,称每瓦性能提升 10 倍 — nvidia · 2026-07-22
- 【源头】英伟达 Rubin 架构曝光:HBM4 内存带宽达 22TB/s — charles_irl · 2026-07-22
- CoreWeave 称 Vera Rubin NVL72 每瓦 tokens 提升 10 倍 — mark_k · 2026-07-23
另有 1 条近重复转述:nvidia