Cerebras与Blackwell打造商用AFD架构,3T参数模型推理提速14倍

teortaxesTex · x · 2026-08-14

Cerebras 与 Nvidia Blackwell 结合的 AFD (Attention FFN Disaggregation) 架构开始投入商用。该系统通过硬件分工加速超大模型推理:由 Blackwell 负责注意力机制和预填充,而 Cerebras 芯片专门执行前馈网络(FFN)。

该方案已成功应用于超过 3 万亿参数的模型(如 OpenAI 预览的 GPT-5.6 Sol),实现了最高 14 倍的推理速度提升。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →