OpenAI 硬件副总裁详谈自研芯片 Jalapeño:九个月流片
ymatias · x · 2026-09-18
OpenAI 硬件副总裁 Richard Ho 在 The Data Exchange 播客中详解公司首颗自研 AI 加速器 Jalapeño:团队借助 AI 工具将部分开发周期压缩到仅 九个月完成流片。要点包括:
- 自研动机:掌控更多硬件栈以降低推理成本、提升性能;架构上让内存与计算更靠近,打破吞吐与延迟的取舍,面向通用 LLM 与开源模型。
- 软件栈:讨论 CUDA 是否仍是护城河、Triton、prefill/decode 优化、用 AI 优化 kernel、投机解码;提及 InferenceX 与 AgentX 基准。
- 路线图:从第一代到第三代,HBM4 与新内存;认为电力而非芯片正成为数据中心瓶颈。
- AI 辅助工程:越来越强的 AI 工具可能让专家工程团队生产力大幅跃升,Jalapeño 的经历预示 AI 辅助工程设计的未来。
所属事件:OpenAI首芯片Jalapeño曝光:9个月流片(5 条相关)→
「Infra」频道最新
- 421M 参数 Laya 模型经 OpenVINO INT8 量化后纯 CPU 玩 Flappy Bird — simpleuserhere · 2026-09-23
- 16GB 显存跑 Qwen3.8-27B 上 160k 上下文,全套配置公开 — According_Study_162 · 2026-09-23
- MLX-Serve 发布 v26.95:Qwen-Image 2.1 上 Mac,四路并发提速近一倍 — TheMoonMidas · 2026-09-23
- DigitalOcean Managed Agents 公测:闲置即暂停,接 75+ 模型 — HeyAmit_ · 2026-09-23
- 换掉最终决策层:Qwen+SGLang 比 Jev 快 37% 且精度相当 — VeryWellVersed · 2026-09-23
- Reka EdgeQ 端侧 VLM 登陆骁龙 8 Elite,首 token 仅 0.73 秒 — RekaAILabs · 2026-09-23