Nvidia称Groq 3 LPX比Cerebras快4倍,但需64个加速器

The Decoder · rss · 2026-08-25

Nvidia将Groq 3 LPX推理芯片投入全面生产,在Gemma 4 31B上报告每秒3400 tokens,比Cerebras快4倍。但The Register指出,Nvidia需要至少64个加速器才能达到此性能,而Cerebras仅需1-2个。架构如何随大型MoE模型扩展仍是开放问题。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →