NVIDIA Groq 3 LPX 投产:3400 tokens/s 助力 Agent 飞驰
heypearlai · x · 2026-08-25
NVIDIA 宣布 Groq 3 LPX 交互式 AI 推理加速器正式投产。作为 Vera Rubin 平台的扩展,该芯片在运行 Gemma 4 31B 模型时实现了每秒 3400 个 Token 的生成速度,上下文窗口达 10 万,创下同类模型最快记录。Nebius 已成为首个采用该芯片的 AI 云服务商。这将显著提升 Agent 系统在编码等复杂任务中的响应速度。
所属事件:英伟达 Groq 3 LPX 全面量产,Nebius 首家上线(7 条相关)→
「Infra」频道最新
- SemiAnalysis:NVIDIA 推理效能最高领先 AMD 5 倍 — rohanpaul_ai · 2026-08-25
- SemiAnalysis: AMD软件拉跨,Nvidia成本优势高达5倍 — rohanpaul_ai · 2026-08-25
- 研究称美国GDP统计低估Nvidia贡献,增长率少算0.3% — aidan_mclau · 2026-08-25
- 微软模型路由器:将模型选择视为反馈循环 — WirelessLife · 2026-08-25
- 通义 Qwen3.8-27B 跻身前沿模型行列 — wandb · 2026-08-25
- Mistral 携手沙特 HUMAIN,共建本地化前沿 AI 模型与基础设施 — MistralAI · 2026-08-25