Nebius 率先采用 NVIDIA Groq 3 LPX 加速推理

BenBajarin · x · 2026-08-25

Nebius AI Cloud 宣布成为首个采用 NVIDIA Groq 3 LPX 的云服务商,旨在提升 NVIDIA Vera Rubin NVL72 的 Token 生成速度。Groq 3 LPX 专为长上下文、低延迟的 Agent 工作负载设计,单机架搭载 256 个 LPU 加速器。实测数据显示,运行 Gemma 4 31B 时输出速度达每秒 3400 Token,创该模型最快纪录。

所属事件:英伟达Groq 3 LPX全面量产,Nebius首家云接入(4 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →