OpenAI Jalapeño 芯片曝光:RTL 冻结到流片仅 9 个月
thehiphopswami · x · 2026-09-04
Hot Chips 上最重磅的 30 分钟
OpenAI 的 Jalapeño 自研芯片规格本身不错但并非重点:6 颗 HBM4、216GB 显存、15.4 TB/s 带宽、700W,围绕投机解码设计。官方称在 DeepSeek R1 上每瓦 token 吞吐较 GB300 高 1.7x,且基线 GB300 还被允许使用投机解码,Jalapeño 只跑单 token 预测——等于让分。
真正的故事是流程
- 一支几乎没有传统芯片设计经验的小团队
- 使用一门类 Rust 的新硬件描述语言,让 AI 开箱即写出正确代码
- 内部用 AI 优化回路迭代设计,从功能正确做到超越专家水平
- RTL 冻结到流片仅 9 个月,首次流片到实际服务 ChatGPT 只用 10 周
- 第二代已接近流片
作者认为这动摇了被守护 40 年的芯片设计护城河:AI 参与设计本身成为新的方法论。
「Infra」频道最新
- ASML 光刻机大量使用 FPGA,Xilinx 曾成医疗设备产能瓶颈 — PAstynome · 2026-09-04
- Tenstorrent 推 JapanFold:开源药物发现模型免 API 试用 — DavidBennett__ · 2026-09-04
- 斯坦福 Prefix Sliding:只留前缀和滑窗,推理提速约 3 倍不重训 — rohanpaul_ai · 2026-09-04
- 分析师:至今没有非 NVIDIA 训练的模型能击败 NVIDIA 训练的模型 — BenBajarin · 2026-09-04
- 2023 年配的台式机如今比购入价还贵,成升值资产 — Darpinian · 2026-09-04
- 联想 IFA 发布数十款 AI 终端,RTX Spark 本本本地跑千亿模型 — 智东西 · 2026-09-04