SemiAnalysis:4-hi HBM 同带宽更省成本, Rubin Ultra 降为 8-hi 192GB
maksym_andr · x · 2026-09-15
SemiAnalysis 付费文章核心观点:HBM 高堆叠趋势正在逆转。
- 下一代加速器以 8-hi 取代 12-hi 为新标准:英伟达 Rubin Ultra 从 288GB/GPU 降至 192GB(SemiAnalysis 首先报道),供应链已转向 8-hi,而不到一年前业界还在期待 16-hi;
- 对以带宽为王的推理负载,4-hi HBM 提供最优的 $/带宽、最低的每 token 成本;容量超过阈值后收益递减,但增量位仍带来同等 BOM 成本;
- 主要实验室的 ASIC 硬件团队计划从 HBM4 世代起采用该路线,与在数据中心电力约束下最大化 tokens/Watt 的思路一致。
这也解释了当前极端 DRAM 产能短缺为何可能缓解。
所属事件:SemiAnalysis:HBM 堆叠转向 8-hi,同带宽成本更低(2 条相关)→
「Infra」频道最新
- 图解 Continuous batching:vLLM 23 倍吞吐背后的调度技术 — blaizedsouza · 2026-09-15
- 区域锁定模型 ID:六条生产级 AI 路由合规实践 — blaizedsouza · 2026-09-15
- 定制ASIC 3.0:大厂在计算与网络间混搭供应商,格局大洗牌 — BenBajarin · 2026-09-15
- AMD 收购 Taalas:把整个模型烧进芯片,Llama 3.1 8B 跑出约 17000 tokens/s — acmoytoy · 2026-09-15
- 微软发布 MulticloudDB SDK:一套 Java API 通吃 Cosmos DB、DynamoDB 与 Spanner — adnan_hashmi · 2026-09-15
- Oracle 高管:Agent 时代,数据库才是记忆的最后一道防线 — AI Engineer · 2026-09-15