Nebius 上线 NVIDIA Groq 3 LPX,Rubin 系统每兆瓦 agent 吞吐提升至 30 倍
demian_ai · x · 2026-08-25
Nebius 宣布成为首个在自有平台上线 NVIDIA Groq 3 LPX 的 AI 云,将超低延迟推理与领先开源模型的生产运行整合到同一平台。
配合的思考框架是「AI 工厂」:电力才是稀缺资源,衡量标准不是峰值 FLOPS,而是固定兆瓦内能完成多少顺序 agent 步骤。据引述数据,Vera Rubin NVL72 在真实 agentic coding 轨迹(上下文增长、工具调用、子 agent)上相比上一代实现最高 30 倍的每兆瓦吞吐。
整套平台为完整闭环协同设计:Vera CPU 负责喂给 GPU 编排与工具调用,Rubin 做重计算,LPX 处理低延迟生成步骤——即过去顺序调用容易堆积卡顿的环节。
所属事件:英伟达 Groq 3 LPX 量产,Nebius 首家上线(7 条相关)→
「Infra」频道最新
- Pipette 开源端侧模型评测套件 — JosephJacks_ · 2026-08-25
- Mistral 携手沙特 HUMAIN,共建本地化前沿 AI 模型与基础设施 — MistralAI · 2026-08-25
- 计划自费百美元 benchmark Qwen 量化与 KV 缓存 — m_mukhtar · 2026-08-25
- Lovable 峰值每秒创 250 仓库,Code.Storage 支撑 AI 编程基建 — dhruv2038 · 2026-08-25
- SpaceX 太空数据中心构想:核心仅芯片、供电与散热 — XFreeze · 2026-08-25
- NVIDIA 机架引入 Groq 芯片:按工作负载拆分推理算力 — rohanpaul_ai · 2026-08-25