Gemma 4 31B 在 Groq 3 跑出 3431 tok/s

GlennCameronjr · x · 2026-08-27

NVIDIA 的 Groq 3 LPX 加速器基准测试显示,Gemma 4 31B 模型在 10k 和 100k 输入序列下的平均输出速度均约为 3,400 tokens/s,创造了该模型在 10 万上下文长度下的最快记录。

所属事件:NVIDIA Groq 3 LPX实测:小模型解码速度超3400 tok/s(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →