Jalapeño 让 DeepSeek R1 推理延迟降低 4.9 倍

AccBalanced · x · 2026-08-26

测试显示,Jalapeño 在 DeepSeek R1 670B 模型上显著提升了推理效能。在测试速度范围内,每瓦吞吐量更高,在同等效率下相比 GB300 延迟降低约 4.9 倍。随着工作负载从效率导向转向高交互推理,Jalapeño 保持领先优势。

所属事件:OpenAI 首款自研推理芯片 Jalapeño 实测数据公布(42 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →