Cerebras与Blackwell打造商用AFD架构,3T参数模型推理提速14倍
teortaxesTex · x · 2026-08-14
Cerebras 与 Nvidia Blackwell 结合的 AFD (Attention FFN Disaggregation) 架构开始投入商用。该系统通过硬件分工加速超大模型推理:由 Blackwell 负责注意力机制和预填充,而 Cerebras 芯片专门执行前馈网络(FFN)。
该方案已成功应用于超过 3 万亿参数的模型(如 OpenAI 预览的 GPT-5.6 Sol),实现了最高 14 倍的推理速度提升。
「Infra」频道最新
- RTX 5090 跑 MiniMax 视频模型仅占 20GB 显存 — BoredHobbes · 2026-08-14
- Meta 将分享吉瓦级 AI 集群网络架构经验 — thoefler · 2026-08-14
- Mistral AI 转型基建:拟建 1GW 算力,推算力预售融资 — demian_ai · 2026-08-14
- SK海力士:到2027年中美将占全球95%的AI算力需求 — nugurimt · 2026-08-14
- AWS 推出多项重磅更新:DynamoDB 支持向量检索 — _jaydeepkarale · 2026-08-14
- UIUC 推出 LLMRouter:大模型路由统一基础设施与基准 — UIUC-CS · 2026-08-14