英伟达 Groq 3 LPX 投产,推理速度创纪录
nvidia · x · 2026-08-24
英伟达宣布 Groq 3 LPX 交互式 AI 推理加速器已全面投产。作为 Vera Rubin 平台的扩展,该芯片在运行 Gemma 4 31B 模型时实现了每秒 3400 个输出令牌的创纪录速度,显著提升智能体系统的响应速度。Nebius 将成为首个采用该芯片的 AI 云服务提供商。
所属事件:英伟达Groq 3 LPX全面量产,Nebius首家云接入(4 条相关)→
「Infra」频道最新
- OneTriangleAI 推出极低延迟 DeepSeek V4 托管 — ycombinator · 2026-08-25
- Modular 跑 GLM-5.2 登顶帕累托前沿,性价比之王 — clattner_llvm · 2026-08-25
- Nvidia 高管称数据中心现受限于电力 — firstadopter · 2026-08-25
- llama.cpp 重启 ROCm 7.14 夜间构建,求 7900XTX 脚本 — W61k3r · 2026-08-25
- 利用小模型子智能体优化上下文工程与 RAG 成本 — samsamy7 · 2026-08-25
- 英伟达 Vera CPU 高管称 Agentic AI 是史上最复杂计算负载 — firstadopter · 2026-08-25