曝 OpenAI 曾向三星求购 4-Hi HBM 配置被拒,基底的供应吃紧
zephyr_z9 · x · 2026-09-17
爆料人 zephyrz9 称,4-Hi HBM 堆叠配置面临基底裸片供应约束,且存储厂商对该配置有抵触,但 AI 实验室非常青睐这一方案。据称 OpenAI 曾向三星提出采购该配置,但目前被拒绝。
他还算了一笔账:以 fp4 精度存放一份模型权重需要约 20TB HBM;以华为假设中的 4-Hi XPU 为例,单卡 4GB×4-Hi×6 堆栈≈96GB HBM,一个 4096 卡的 scale-up 节点将拥有超过 384TB HBM,对应华为 4096 加速器的 scale-up 世界规模。
所属事件:传华为拟扩4096卡超节点HBM可达384TB(2 条相关)→
「Infra」频道最新
- LinkedIn 工程师将展示以 PyTorch 为运行时的 GPU 检索引擎 — PyTorch · 2026-09-18
- vLLM 深度优化 Kimi K3 推理:吞吐提升 2.2–2.8 倍 — vllm_project · 2026-09-17
- AWS 官方对比 Bedrock 三种向量库:OpenSearch、pgvector 与 S3 Vectors — AWS ML Blog · 2026-09-17
- Baseten 优化 pyannote 说话人分离:吞吐提升 3.2 倍延迟降 9.6 倍 — baseten · 2026-09-17
- huggingface_hub v1.32.0 上线共享下载缓存,跨仓库复用 16.8GB 权重 — vanstriendaniel · 2026-09-17
- 富士通正式发布 MONAKA:144 核 ARM 数据中心 CPU — Fcking_Chuck · 2026-09-17