AMD 与 Cerebras 推出 GPU、CPU 和 wafer-scale 推理方案
ryanshrout · x · 2026-07-24
AMD 和 Cerebras 讨论低延迟分布式推理方案
帖子展示的是一次现场讨论:AMD 的 Lisa Su 与 Cerebras 团队提到,要在 Helios GPU/CPU 机架 上构建一种 分布式推理方案,并与 Cerebras 的 wafer-scale 引擎 配合使用。
配图里的幻灯片把这套组合定义为面向 超低延迟推理 的方案,思路是把两类硬件分工:
- AMD Instinct 负责 高吞吐、可扩展计算
- Cerebras wafer-scale 负责 低延迟推理
本质上是在讲,把吞吐型 GPU/CPU 机架和 wafer-scale 芯片组合起来服务推理负载。
所属事件:AMD与Cerebras联手推出超低延迟推理方案(2 条相关)→
「Infra」频道最新
- Google Cloud 收入达 248 亿美元,TPU 营收和巨额 capex 加码 AI — DavidLinthicum · 2026-07-24
- AMD 称 MI350P 在企业工作负载上可提升 2–5 倍性价比 — ryanshrout · 2026-07-24
- Databricks Genie 以 MCP 接入 LangGraph,并部署到 Azure ML — Cautious-Meringue554 · 2026-07-24
- 有人把 Hugging Face 搬到 NAS,本地加速模型传输到 AI 主机 — TyedalWaves · 2026-07-24
- AMD 推出 MI350P,主打企业机房空气冷却大模型推理 — BenBajarin · 2026-07-24
- AMD 把 MI350P 定位成更易落地的企业本地 AI 芯片 — ryanshrout · 2026-07-24