AMD与Cerebras达成历史性合作,推出 disaggregated 推理架构
Sethwinterroth · x · 2026-07-24
AMD 与 Cerebras 宣布达成历史性合作,推出一种全新的 disaggregated(解耦)推理架构。该架构结合了双方的优势:
- AMD Helios:负责提供世界级的 prefill(预填充)性能。
- Cerebras 晶圆级引擎:负责提供业界最快的 decode(解码)速度。
这种新架构打破了传统 AI 推理中吞吐量与延迟之间的权衡。通过实现大规模的超低延迟,该架构将极大提升 AI 应用的响应速度,有望催生出全新一代的用户体验、机器人创新、软件开发范式以及科学发现。
所属事件:AMD与Cerebras合作推出解耦式超低延迟推理架构(5 条相关)→
「Infra」频道最新
- 泄露通话稿称 DeepSeek 仅有约两万张 H 级算力卡 — fiiiiiist · 2026-07-24
- NVIDIA 预告 NVFP4:更便宜的 LLM 推理路径 — NVIDIA Developer · 2026-07-24
- 投资人质疑:将Transformer固化进芯片是死路一条 — JosephJacks_ · 2026-07-24
- 华为与 GB300 的 4:1 算力差,按带宽算只剩 2:1 — zephyr_z9 · 2026-07-24
- NVIDIA 发布 NVFP4:更省显存的 LLM 推理格式 — NVIDIA Developer · 2026-07-24
- DeepSeek-V4-Flash 在两张 4090D 上跑到 105 tok/s — iSevenDays · 2026-07-24