SemiAnalysis:4-hi HBM 同带宽更少die,推理成本更低成新趋势
dylan522p · x · 2026-09-14
SemiAnalysis 最新付费文章指出,DRAM 极度短缺背景下,HBM 堆叠趋势正在逆转:下一代加速器将从当前 12-hi 标准转向 8-hi,Nvidia Rubin Ultra 即是如此——单卡容量从 288GB 降至 192GB。
更关键的判断:对以带宽为核心的推理负载,4-hi HBM 能提供最优的每美元带宽、即最低每 token 成本;容量在超过阈值后边际收益递减,但增量堆叠仍带来同样成本。主要实验室的 ASIC 硬件团队已计划从 HBM4 世代起采用 4-hi 方案,与「在数据中心功耗约束下最大化 tokens/Watt」的思路一致。
「Infra」频道最新
- 把所有 AI API 额度统一为单一代币货币的设想 — sull · 2026-09-14
- 2x P40 跑 Qwen 27B:并行 agent 打散 KV 缓存的实战难题 — Jumpy-Operation-4615 · 2026-09-14
- 反讽:AI 放缓像集体行动难题?台积电靠误判需求就做到了 — dan_s_becker · 2026-09-14
- 低价 token 服务商藏雷:假 tool call 窃密、转卖完整 trace — Nils_Reimers · 2026-09-14
- 二手 RTX 5090 挂到 £3900/约 5200 美元,价格离谱 — julianharris · 2026-09-14
- 亚马逊微软在电力之争中站队社区对抗公用事业公司 — pstAsiatech · 2026-09-14