AMD 联手 Cerebras 推超低延迟解耦推理方案
ryanshrout · x · 2026-07-24
AMD 和 Cerebras 展示了一套解耦式推理方案:把 Helios 机架里的 GPU、CPU 与 Cerebras 的晶圆级引擎结合起来。
这套方案计划在今年晚些时候上线 Cerebras Cloud,目标是超低延迟 AI 推理场景。配图还给出了“在领先 AI 模型上最高 5x TPS/W”的说法,并把它解读为对 NVIDIA + Groq 合作的直接回应。
所属事件:AMD与Cerebras联手推出超低延迟推理方案(2 条相关)→
「Infra」频道最新
- Databricks Genie 以 MCP 接入 LangGraph,并部署到 Azure ML — Cautious-Meringue554 · 2026-07-24
- 有人把 Hugging Face 搬到 NAS,本地加速模型传输到 AI 主机 — TyedalWaves · 2026-07-24
- AMD 推出 MI350P,主打企业机房空气冷却大模型推理 — BenBajarin · 2026-07-24
- TSMC CEO 直言羡慕存储厂商 86% 的毛利率 — Beth_Kindig · 2026-07-24
- PyTorch 的 Helion DSL 开始支持通过 Pallas 编写 TPU kernel — PyTorch · 2026-07-24
- 百美元级 Celeron 单板机实测:0.6B 模型还能用 — tre7744 · 2026-07-24