Nvidia Groq 3 LPX 系统实测:小模型解码超 3400 tok/s
Jsevillamol · x · 2026-08-27
Nvidia 提出的 Groq 3 LPX 系统在 Gemma 4 31B 模型上实现了超过 3400 tok/s 的解码速度。该系统通过使用 128GB 超快 SRAM 替代 HBM 实现这一性能,并建议将 LPUs 与 GPU 结合以将此速度扩展到前沿模型。
所属事件:NVIDIA Groq 3 LPX实测:小模型解码速度超3400 tok/s(2 条相关)→
「Infra」频道最新
- Google Cloud Run 推出实例:单命令部署 Linux 微 VM — steren · 2026-08-27
- 求助:llama.cpp 运行 Qwen 3.8 Flash Next 遇到崩溃 — tryunite · 2026-08-27
- Anthropic 签 45 亿美元算力协议,部署英伟达 Rubin 芯片 — Beth_Kindig · 2026-08-27
- DeepSeek-v4-Pro 1美元生成1.3亿Token,成本骤降77倍 — bookwormengr · 2026-08-27
- NVIDIA FLARE 实现联邦多模态训练,通信量降 99% — dl_weekly · 2026-08-27
- 同预算怎么选:256GB Mac 还是两台 DGX Spark — Whyme-__- · 2026-08-27