Liquid AI 发布 DSpark 草稿模型,VL 模型推理最高提速 3.13 倍

JosephJacks_ · x · 2026-09-25

Liquid AI 为其视觉语言模型 LFM2.5-VL-3B 发布实验性 DSpark 草稿模型,引入投机解码:轻量 drafter 一次提出多个 token,目标模型单次验证,不改变输出质量。实测(batch size 1、temperature 0):MLX 在 M5 Max 上解码最高快 3.13 倍、端到端 2.62 倍;llama.cpp 在 M3 Ultra 上解码 2.14 倍、端到端 1.77 倍;SGLang 在 H100 上解码 2.66 倍、端到端 2.27 倍。评测数据来自其公开基准设施 Pipette。

所属事件:Liquid AI 推出 DSpark 投机解码,VL 模型提速超 3 倍(4 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →