NVIDIA Groq 3 LPX 投产:3400 tokens/s 助力 Agent 飞驰

heypearlai · x · 2026-08-25

NVIDIA 宣布 Groq 3 LPX 交互式 AI 推理加速器正式投产。作为 Vera Rubin 平台的扩展,该芯片在运行 Gemma 4 31B 模型时实现了每秒 3400 个 Token 的生成速度,上下文窗口达 10 万,创下同类模型最快记录。Nebius 已成为首个采用该芯片的 AI 云服务商。这将显著提升 Agent 系统在编码等复杂任务中的响应速度。

所属事件:英伟达 Groq 3 LPX 全面量产,Nebius 首家上线(7 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →