Jalapeño 让 DeepSeek R1 推理延迟降低 4.9 倍
AccBalanced · x · 2026-08-26
测试显示,Jalapeño 在 DeepSeek R1 670B 模型上显著提升了推理效能。在测试速度范围内,每瓦吞吐量更高,在同等效率下相比 GB300 延迟降低约 4.9 倍。随着工作负载从效率导向转向高交互推理,Jalapeño 保持领先优势。
所属事件:OpenAI 首款自研推理芯片 Jalapeño 实测数据公布(42 条相关)→
「Infra」频道最新
- Perplexity发布NVIDIA DGX本地Agent栈 — AravSrinivas · 2026-08-26
- 曝 M5 Ultra 内存带宽 1.2TB/s,本地跑 Kimi 超 API — StefanoGogioso · 2026-08-26
- 数据中心反对潮并非源于反科技情绪 — AndyMasley · 2026-08-26
- AI代理安全市场争夺战:Zscaler能否成为企业安全默认控制面? — thedealdirector · 2026-08-26
- RTX 3060+2060 跑 Qwen 27B:仅 5-6 TPS 勉强可玩 — sheriffoftiltover · 2026-08-26
- PyTorch PR 修复 FSDP 模块静态特化问题 — ezyang · 2026-08-26