Nebius 上线 NVIDIA Groq 3 LPX,Rubin 系统每兆瓦 agent 吞吐提升至 30 倍

demian_ai · x · 2026-08-25

Nebius 宣布成为首个在自有平台上线 NVIDIA Groq 3 LPX 的 AI 云,将超低延迟推理与领先开源模型的生产运行整合到同一平台。

配合的思考框架是「AI 工厂」:电力才是稀缺资源,衡量标准不是峰值 FLOPS,而是固定兆瓦内能完成多少顺序 agent 步骤。据引述数据,Vera Rubin NVL72 在真实 agentic coding 轨迹(上下文增长、工具调用、子 agent)上相比上一代实现最高 30 倍的每兆瓦吞吐。

整套平台为完整闭环协同设计:Vera CPU 负责喂给 GPU 编排与工具调用,Rubin 做重计算,LPX 处理低延迟生成步骤——即过去顺序调用容易堆积卡顿的环节。

所属事件:英伟达 Groq 3 LPX 量产,Nebius 首家上线(7 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →