NVIDIA 机架引入 Groq 芯片:按工作负载拆分推理算力

rohanpaul_ai · x · 2026-08-25

NVIDIA 与 Groq 达成非独占授权 8 个月后,Groq 技术首次出现在 NVIDIA 机架级产品中,Groq 机柜今年内上线。NVIDIA 正把 agentic AI 的工作负载拆分到专用处理器:Rubin GPU 负责重模型计算,Groq 3 LPX 面向延迟敏感的 token 生成,Vera CPU 运行代码、工具与数据处理。

作者指出,智能体任务中后续步骤常需等待前序完成,token 生成延迟的影响会在长任务中复利式放大;NVIDIA 宣称 Groq 3 LPX 对比 Cerebras 推理平台有 4 倍响应性提升,因此这种改善会在长任务中累积。这是推理硬件正按工作负载碎片化的一个重要信号。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →