专题 · FULL STORY
Vera Rubin 实测数据连环放出
NVIDIA 先是公布 Vera Rubin NVL72 基于硅片的实测数据,称 AI Agent 场景效能较 GB300 最高提升 30 倍,随后又引用 SemiAnalysis 的 AgentX 基准结果,称能效领先竞品 30 倍,持续为下一代芯片造势。
2026-08-24 ~ 2026-08-29 · 2 集 · 7 条
第 1 集 · NVIDIA 公布 Vera Rubin 实测:Agent 场景效能超 GB300 达 30 倍(2026-08-24,5 条)
NVIDIA 首次公布 Vera Rubin(NVL72)芯片基于硅片的实测性能数据:在 AI Agent 实际运行场景下,其表现较上代 GB300 NVL72 有数量级提升,这是 Rubin 架构面向 Agent 时代的首个官方实测验证,值得关注。
已确认
- 测试由 NVIDIA 在其技术博客发布(m1),负载采用 SemiAnalysis 的 AgentX 工作负载和 DeepSeek V4 Pro 模型,针对 AI Agent 实际运行轨迹。
- 在匹配交互性目标下,Vera Rubin 每兆瓦吞吐量较 GB300 NVL72 提升高达 30 倍;智能体编码 Token 成本降低 35 倍(m4、m5)。
- 测试通过重放生产级编码 Agent 会话进行,包含长上下文、KV 缓存复用等真实场景(m3)。
- 消息在 8 月 24 日由 @nvidia 官方与 @nordicinst 等账号发布,随后经 @Scobleizer、@brianryhuang 等转发扩散。
为什么重要
- 这是 NVIDIA 首次以硅片实测(而非纸面规格)展示 Rubin 架构实力,且测试瞄准 AI Agent 这一新兴主流负载,而非传统训练/推理基准。
- 每兆瓦吞吐与 Token 成本两个指标直击数据中心能效与单位智能成本,对规划下一代算力采购的云厂商与 Agent 应用团队有直接参考意义。
- @Crescitaly 提醒,该数据为 NVIDIA 官方宣称,源自其自家技术博客,第三方独立复现尚未出现,采信时需留意口径(如「匹配交互性目标」等测试条件)。
尚未确认
- 第三方独立复测结果尚未出现,30 倍/35 倍两项数字目前仅基于 NVIDIA 单方口径。
- NVIDIA 公布 Rubin 芯片实测:Agent 场景效能超 GB300 三十倍 — nvidia · 2026-08-24
- 英伟达 Rubin NVL72:每瓦工作量较上代提升 30 倍 — nordicinst · 2026-08-24
- NVIDIA Vera Rubin 实测:智能体编码成本降 35 倍 — brianryhuang · 2026-08-25
- NVIDIA Vera Rubin 实测:Agent 负载吞吐量提升 30 倍 — Scobleizer · 2026-08-25
- NVIDIA 宣称 Rubin 架构 Agent 吞吐量提升 30 倍 — Crescitaly · 2026-08-26
第 2 集 · NVIDIA:Rubin NVL72 在 AgentX 基准能效领先竞品 30 倍(2026-08-29,2 条)
NVIDIA 官方引用 SemiAnalysis 开发的 AgentX 基准测试结果,展示其 Vera Rubin NVL72 系统的性能。AgentX 是首个面向多轮 Agent 工作流的开源基准,上下文长度可达 100 万 token。在模拟真实 Agent 运行的工作负载下,测试显示 Vera Rubin NVL72 系统的吞吐量与能效比较竞品高出 30 倍。
- NVIDIA 测试显示 Rubin NVL72 较竞品能效提升 30 倍 — nvidia · 2026-08-29
- NVL72实测AgentX吞吐量能效比竞品高30倍 — nvidia · 2026-08-29