OpenAI 硬件 VP 详述首颗自研芯片 Jalapeño:9 个月流片
thehiphopswami · x · 2026-09-18
OpenAI 硬件副总裁 Richard Ho 在 The Data Exchange 播客中详解公司首颗自研 AI 加速器 Jalapeño:
- 为何自研:掌控更多硬件栈可降低推理成本、提升性能,芯片同时追求高吞吐与低延迟,面向通用 LLM 与开源模型设计。
- 架构特点:白板式设计让内存与计算更靠近,打破吞吐与延迟的权衡;低延迟对多模态 AI 尤为关键。
- AI 加速研发:AI 工具把部分开发周期压缩至 9 个月完成流片;AI 也被用于优化 kernel。
- 路线图:下一代将引入 HBM4 与新内存;讨论 prefill/decode、speculative decoding、CUDA 是否仍是护城河,以及 agent 与强化学习对推理需求的拉动。
- 他认为电力而非芯片正成为数据中心瓶颈。
所属事件:OpenAI首芯片Jalapeño曝光:9个月流片(5 条相关)→
「Infra」频道最新
- 421M 参数 Laya 模型经 OpenVINO INT8 量化后纯 CPU 玩 Flappy Bird — simpleuserhere · 2026-09-23
- MLX-Serve 发布 v26.95:Qwen-Image 2.1 上 Mac,四路并发提速近一倍 — TheMoonMidas · 2026-09-23
- DigitalOcean Managed Agents 公测:闲置即暂停,接 75+ 模型 — HeyAmit_ · 2026-09-23
- 换掉最终决策层:Qwen+SGLang 比 Jev 快 37% 且精度相当 — VeryWellVersed · 2026-09-23
- Reka EdgeQ 端侧 VLM 登陆骁龙 8 Elite,首 token 仅 0.73 秒 — RekaAILabs · 2026-09-23
- 为 OpenCode 写缓存友好压缩插件,本地模型提速近 10 倍 — schennardo · 2026-09-23