曝 OpenAI 芯片计划:GPT 模型推理或提速 50 倍
Yuchenj_UW · x · 2026-08-26
根据 OpenAI Jalapeño 芯片博客的数据爆料,新硬件可能带来巨大的推理速度提升:GPT-OSS 120B 达到 22K tok/s,DeepSeek R1 达到 12K tok/s,Kimi K2.5(1T 参数)达到 6K+ tok/s。如果 OpenAI 能在不大幅涨价的情况下实现 GPT 模型 50 倍的加速,将极大改变行业格局。
所属事件:OpenAI 首款自研推理芯片 Jalapeño 实测数据公布(41 条相关)→
「Infra」频道最新
- NVIDIA Vera Rubin NVL72 机架投产,单托盘组装仅需一分钟 — nvidia · 2026-08-26
- Kern 运行时:本地模型代码的极速安全沙箱 — quiet-systems · 2026-08-26
- 硬件价格难回旧低,万元预算如何选 LLM 算力 — nemuro87 · 2026-08-26
- 一张DGX Spark的钱能搭双3090加128G内存 — QuixiAI · 2026-08-26
- 用 MLX 在 Mac 上训练 iMessages 私有模型 — romainhuet · 2026-08-26
- 评测避坑:Agent 延迟边界定义不当致数据失真 — WirelessLife · 2026-08-26