Gemma 4 31B 在 Groq 3 跑出 3431 tok/s
GlennCameronjr · x · 2026-08-27
NVIDIA 的 Groq 3 LPX 加速器基准测试显示,Gemma 4 31B 模型在 10k 和 100k 输入序列下的平均输出速度均约为 3,400 tokens/s,创造了该模型在 10 万上下文长度下的最快记录。
所属事件:NVIDIA Groq 3 LPX实测:小模型解码速度超3400 tok/s(2 条相关)→
「Infra」频道最新
- vLLM 跑分:DeepSeek V4 Pro 达 13 万 tok/s — AccBalanced · 2026-08-27
- Google Cloud Run 推出实例:单命令部署 Linux 微 VM — steren · 2026-08-27
- 求助:llama.cpp 运行 Qwen 3.8 Flash Next 遇到崩溃 — tryunite · 2026-08-27
- Anthropic 签 45 亿美元算力协议,部署英伟达 Rubin 芯片 — Beth_Kindig · 2026-08-27
- DeepSeek-v4-Pro 1美元生成1.3亿Token,成本骤降77倍 — bookwormengr · 2026-08-27
- NVIDIA FLARE 实现联邦多模态训练,通信量降 99% — dl_weekly · 2026-08-27