Nvidia Groq 3 LPX 系统实测:小模型解码超 3400 tok/s

Jsevillamol · x · 2026-08-27

Nvidia 提出的 Groq 3 LPX 系统在 Gemma 4 31B 模型上实现了超过 3400 tok/s 的解码速度。该系统通过使用 128GB 超快 SRAM 替代 HBM 实现这一性能,并建议将 LPUs 与 GPU 结合以将此速度扩展到前沿模型。

所属事件:NVIDIA Groq 3 LPX实测:小模型解码速度超3400 tok/s(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →