SpecFold 利用多分支冗余,扩散语言模型推测解码提速至 1.99x

GeorgiaTech · hf · 2026-10-10

佐治亚理工团队提出 SpecFold,一种算法-系统协同设计,加速扩散大语言模型(DLLM)的多分支推测解码。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →