OpenAI Jalapeño 推理芯片深度解析
thehiphopswami · x · 2026-08-28
本期节目深入探讨了 OpenAI 在 Hot Chips 大会上发布的 Jalapeño 推理芯片。核心观点包括:
- 架构设计:采用 NUMA 风格的本地 HBM 切片,解决了操作数延迟问题;利用 AI 辅助 EDA 设计,仅用 9 个月即完成从 RTL 到流片,达到 Blackwell 级别。
- 成本与性能:提出“暗硅比空闲加速器更便宜”的理念,认为一块均衡芯片优于 GPU + LPU 组合。
- 扩展性:通过 Broadcom ESUN 架构,单机柜支持 128 芯片(600 GB/s),16 机柜互联可达 2048 芯片(200G)。
- 行业影响:讨论了该芯片是否对外销售、RTL 代码的 AI 编写比例,以及 Anthropic 在芯片领域的缺位。
「Infra」频道最新
- NVIDIA 推出 Mesh 开源计算网络,聚合闲置 GPU 跑 AI — nvidia · 2026-08-28
- AI 自动化研究发现 vLLM/SGLang 底层数值错误 — josh_tobin_ · 2026-08-28
- llama.cpp 定制分支:M1 Ultra 上 Metal 加速 Qwen3.8 推理 — tarruda · 2026-08-28
- Hot Chips 观察:推理芯片进入「群雄 ferment 时代」 — BenBajarin · 2026-08-28
- 实测 Muon 优化器:残差梯度平滑且稳定 — stochasticchasm · 2026-08-28
- 分析师预测 CXL 标准将走向商用,有望打破内存墙 — BenBajarin · 2026-08-28