Nebius 率先采用 NVIDIA Groq 3 LPX 加速推理
BenBajarin · x · 2026-08-25
Nebius AI Cloud 宣布成为首个采用 NVIDIA Groq 3 LPX 的云服务商,旨在提升 NVIDIA Vera Rubin NVL72 的 Token 生成速度。Groq 3 LPX 专为长上下文、低延迟的 Agent 工作负载设计,单机架搭载 256 个 LPU 加速器。实测数据显示,运行 Gemma 4 31B 时输出速度达每秒 3400 Token,创该模型最快纪录。
所属事件:英伟达Groq 3 LPX全面量产,Nebius首家云接入(4 条相关)→
「Infra」频道最新
- Abacus AI 推出 SuperComputer:集成百款模型的云端工作站 — thetripathi58 · 2026-08-25
- Agent 落地陷阱:Demo 很美,生产环境靠基建 — EmetInteractive · 2026-08-25
- 分析师质疑英伟达财务操作,Vera Rubin 难掩 AI 经济隐忧 — TiernanRayTech · 2026-08-25
- LiquidAI 联手发布手机端小模型评测基准 — JosephJacks_ · 2026-08-25
- Mesh LLM:多台设备联网跑大模型 — alex_verem · 2026-08-25
- 戴尔联手 Groq 与英伟达,部署下一代 AI 推理云 — IanAndrewsDC · 2026-08-25