Rubin算力增速快于带宽

Beth_Kindig · x · 2026-07-11

Beth Kindig 指出,NVIDIA Rubin 的推理算力据称是 Blackwell 的 5 倍,但 HBM 带宽只提升 2.8 倍,因此“内存墙”依然存在。

文章的核心判断是:随着超大规模云厂商从 AI 扩张转向 AI 变现,更高效地利用内存会变得更重要;其中,offload engine 被视为提升 tokens per watt 的关键方案。

所属事件:英伟达Rubin算力增5倍但内存墙犹存(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →