Liquid AI 发布 DSpark 推理加速,吞吐提升 3 倍

JosephJacks_ · x · 2026-08-21

Liquid AI 发布了 LFM2.5 系列的 DSpark draft 模型,引入推测解码路径。该方法通过轻量级模型提出候选 token,再由主模型一次前向传播验证,仅增加少量内存即可大幅提升解码速度。实测显示,在 H100 上吞吐量最高提升 3.18 倍,在 M4 Max 上提升 2.87 倍,且不改变输出质量。

所属事件:Liquid AI 发布 DSpark 草稿模型,推测解码加速最高 4 倍(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →