NVIDIA 发布 Groq 3 LPX 加速器,Vera Rubin 推理性能提升 4 倍
NVIDIA Blog · rss · 2026-08-24
NVIDIA 宣布 NVIDIA Groq 3 LPX 投入量产,作为 Vera Rubin NVL72 系统的扩展,专为 Agent 时代的低延迟推理设计。在 Gemma 4 31B 模型基准测试中,该系统实现了每秒 3400 个输出令牌,比最近的其他平台快 4 倍。SpaceXAI 宣布采用 NVIDIA Vera CPU 用于其下一代 Agent AI,CoreWeave 和 Nebius 也分别部署了相关网络和加速技术。
「Infra」频道最新
- Cerebras 发布 CS-4 系统:推理速度提升 30 倍 — thione · 2026-08-25
- 端侧与单卡部署实测:Gemma 4 与 Qwen3.8 谁更实用? — lmoroney · 2026-08-25
- Abacus AI 推出 SuperComputer:集成百款模型的云端工作站 — thetripathi58 · 2026-08-25
- Agent 落地陷阱:Demo 很美,生产环境靠基建 — EmetInteractive · 2026-08-25
- 分析师质疑英伟达财务操作,Vera Rubin 难掩 AI 经济隐忧 — TiernanRayTech · 2026-08-25
- Mesh LLM:多台设备联网跑大模型 — alex_verem · 2026-08-25