CoreWeave 称 Vera Rubin NVL72 每瓦 tokens 提升 10 倍
mark_k · x · 2026-07-23
CoreWeave 称 Vera Rubin NVL72 的能效比 GB200 高 10 倍
帖子引用 CoreWeave 对 NVIDIA Vera Rubin NVL72 的首次实测,重点放在推理吞吐与功耗效率:
- 在 DeepSeek R1 上,Vera Rubin NVL72 被称为达到 约 10 倍 tokens/megawatt 的提升。
- 贴文强调,这个结果是在 用户响应延迟相近 的前提下取得的。
- 配图给出的对比大致是:800,000 TPS/MW 对 80,000 TPS/MW,并标注为 10x improvement。
- 结论是:如果这一代硬件表现成立,大规模、持续在线的推理和智能体流量会变得便宜很多。
所属事件:英伟达发布 Vera Rubin 平台主打极致能效(6 条相关)→
「Infra」频道最新
- Polymarket 给出 OpenAI 年内上市概率 19%,算力支出传闻达 7500 亿美元 — Polymarket · 2026-07-23
- OpenAI 据报将 2030 年算力支出预估提至 7500 亿美元 — Polymarket · 2026-07-23
- 算力即“香料”:Meta 拟向 Anthropic 出租 100 亿美元算力 — thealexbanks · 2026-07-23
- Pinokio 8.0.40 热修复 Hugging Face token 失效问题 — cocktailpeanut · 2026-07-23
- 开发者反思本地算力投资:预付费工作站大幅降低实验摩擦 — generativist · 2026-07-23
- Kimi-K3 被估算为 50.4B 激活参数 — StefanoGogioso · 2026-07-23