AI 推理服务器内存格局生变:DRAM 份额将跌 40%
AccBalanced · x · 2026-09-01
AI 基础设施观察者预测,AI 推理服务器中通用 DRAM 的市场份额将下降约 40%,减少的部分将由闪存(Flash)接手,且闪存通过超大规模网络扩展将成为标准。
核心观点包括:
- 定制内存是未来:3D 堆叠或定制底层晶圆(或混合方案)将成为主流。若不与内存供应商紧密合作,厂商将难以生存。
- 制程逼近逻辑芯片:随着计算向内存靠近,底层晶圆将采用领先逻辑制程(如 N4、N3)。
- 代工厂深度协作:预计逻辑代工厂与内存代工厂将展开深度合作。
- 瓶颈转移:Scale-up(扩展)领域成为新瓶颈,预计集群规模将扩展到 128 节点以上,甚至 500+,这将依赖 NPO、VCSEL、铜互连和 PCB 技术。
- SRAM 价值重估:随着负载从“受限于内存”转向“受限于计算”,片上权重(即 SRAM)将变得真正有益。
「Infra」频道最新
- MongoDB CTO 谈数据库架构演进与 Agent 记忆难题 — The Cognitive Revolution · 2026-09-01
- 停止为应用配置长期 AWS 密钥,改用 IAM 临时凭证 — _jaydeepkarale · 2026-09-01
- llama.cpp 优化:Metal 后端提速 12.7% — predatar · 2026-09-01
- 如何跨互联网朋友 PC 搭建分布式 LLM 推理? — BuildWithEren · 2026-09-01
- 在 4 张 2080 Ti 上构建私有 AI 操作系统 — askincihan · 2026-09-01
- Llama Mac 端新增 REST API 请求构建器 — ggerganov · 2026-09-01