SemiAnalysis 拆解 OpenAI Jalapeño:通用推理 ASIC,实测效率超 NVIDIA 与 AMD
zephyr_z9 · x · 2026-08-25
SemiAnalysis 披露了 OpenAI 自研 Jalapeño 芯片的更多细节:
- 并非只为 OpenAI 模型窄化优化,而是一颗通用 LLM 推理 ASIC,从零设计,团队组建到流片仅约 16 个月。
- 在其测试的多个推理效率指标上,表现优于 NVIDIA、AMD 和 Google 的加速器。
- 性能数据:DeepSeek R1 在并发 1 下达到 700+ tokens/s/user;Kimi K2.5 与 GPT-OSS 在部分测试中约 1,400 tokens/s/user。
- 以上成绩基于单 token 预测,未使用投机解码或 prefill/decode 分离。
所属事件:SemiAnalysis 拆解 Jalapeño:通用推理 ASIC 效率超英伟达与 AMD(2 条相关)→
「Infra」频道最新
- 苹果猛攻本地 AI:M5 Ultra 支持统一内存、Mac mini 起价 899 美元 — haider1 · 2026-08-25
- 澳洲拟出新规,AI 公司突击建数据中心以避监管 — nordicinst · 2026-08-25
- OpenAI 宣称新款芯片 Jalapeño 基准测试超 Vera Rubin — Wonderful_Buffalo_32 · 2026-08-25
- Jalapeño 芯片性能超越 TPU,ASIC 竞争格局生变 — GavinSBaker · 2026-08-25
- 观点:模型质量之外,更便宜更快的推理才是胜负手,OpenAI全栈布局将赢 — VraserX · 2026-08-25
- 美国设备出口风险加大,三星与SK海力士加码中国NAND产线升级 — pstAsiatech · 2026-08-25