Nvidia称Groq 3 LPX比Cerebras快4倍,但需64个加速器
The Decoder · rss · 2026-08-25
Nvidia将Groq 3 LPX推理芯片投入全面生产,在Gemma 4 31B上报告每秒3400 tokens,比Cerebras快4倍。但The Register指出,Nvidia需要至少64个加速器才能达到此性能,而Cerebras仅需1-2个。架构如何随大型MoE模型扩展仍是开放问题。
「Infra」频道最新
- 英伟达与Perplexity合作推出便携式计算机 — ryanshrout · 2026-08-25
- 苹果发布 M5 Ultra 芯片:专为 3D 渲染与前沿 AI 模型打造 — Polymarket · 2026-08-25
- 高通新骁龙 Oryon 核心冲 5GHz,引入 FlexCache 适配 Agent 负载 — ryanshrout · 2026-08-25
- iPhone 芯片晶体管数停滞,单核性能仍吊打 PC — lemire · 2026-08-25
- Unsloth AI 将首日支持 Qwen 模型接入 llama.cpp — danielhanchen · 2026-08-25
- 职业新路径:DevOps 工程师如何转型 AI Infra — _jaydeepkarale · 2026-08-25