AI Infra Summit:Vera Rubin 与 DSX 主打每兆瓦 token 产出
NVIDIA Blog · rss · 2026-09-16
NVIDIA 副总裁 Ian Buck 在 AI Infra Summit(参会者超 8000 人,去年 3500)发表基础设施主题演讲,发布多项合作与数据:
- 合作:Amazon Annapurna Labs 共同开发 NVHBM 定制高带宽内存;d-Matrix 将 Raptor XPU 接入 NVLink Fusion;Pinterest 用 Blackwell + Dynamo 推理软件做视觉发现的对话式 AI。
- DSX MaxLPS:Lambda 首次验证,19 节点跑出 16 节点功率预算的吞吐,token 吞吐 +24%、每瓦性能 +23%;Vera Rubin NVL72 同预算最多多 40% GPU 容量。
- Vera Rubin NVL72 + Groq 3 LPX:组合平台对 2 万亿参数级长上下文模型,每兆瓦 token 吞吐最高达 GB200 NVL72 的 35 倍;100K 上下文 Qwen 工作负载实测每用户 2529 output tokens/s。
- SemiAnalysis AgentX 基准:以真实 agent 编码会话测推理,Vera Rubin NVL72 在 DeepSeek 模型上每兆瓦吞吐较 GB300 NVL72 高达 30 倍,每百万 token 成本最高降 45 倍。
- 电网灵活性:Emerald AI 演示 AI 工厂作为可调度电网资源,响应数百次 Silicon Valley Power 需求信号。
「Infra」频道最新
- Oracle 裁员次日新 CFO 全员会:不喜欢「少花钱多办事」这个说法 — mkheck · 2026-09-16
- OpenAI 透露 Astra 在 Rubin 芯片上自我优化 72 小时推理再翻倍 — bookwormengr · 2026-09-16
- 开源端侧语音模型 Audio8:ASR/TTS 七个规格,iPhone 离线转写可用 — FinanceYF5 · 2026-09-16
- RTX Pro 6000 全面售罄,买家称交货周期已长达 8 个月 — Sentdex · 2026-09-16
- Anthropic 已官宣超 11.5GW 算力,满负荷年账单或达 1200 亿美元 — FinanceYF5 · 2026-09-16
- NVIDIA 官方讲解:Dense 与 MoE 架构如何选,部署权衡全解析 — NVIDIA Developer · 2026-09-16