Liquid AI 发布 DSpark:LFM2.5-VL-3B 解码最高提速 3.13 倍
JosephJacks_ · x · 2026-09-25
Liquid AI 发布实验性 DSpark draft 模型,为 LFM2.5-VL-3B 带来投机解码能力:轻量 drafter 一次提出多个 token,目标模型单次验证,不改变输出质量。
在六类视觉-语言任务、batch size 1、temperature 0 下的实测:
- M5 Max 上 MLX:解码最高提速 3.13 倍,端到端 2.62 倍
- M3 Ultra 上 llama.cpp:解码最高 2.14 倍,端到端 1.77 倍
- H100 上 SGLang:解码最高 2.66 倍,端到端 2.27 倍
评测使用其公开基准设施 Pipette 收集。
所属事件:Liquid AI 推出 DSpark 投机解码,VL 模型提速超 3 倍(4 条相关)→
「Infra」频道最新
- Google Project Suncatcher 搭 SpaceX 任务,首次太空测试 TPU 原型 — Miles_Brundage · 2026-09-25
- YC新创Isoquant上线:GLM-5.3-Flash推理$0.07/M,首token仅452ms — ycombinator · 2026-09-25
- 开发者把 NVIDIA Nemotron 3 说话人分离移植到 Apple Silicon 本地运行 — ivan_digital · 2026-09-25
- Horace He 解析怪现象:数据「可预测」时 GPU 矩阵乘法跑得更快 — goyal__pramod · 2026-09-25
- PyTorch 官方宣布 ExecuTorch 端侧黑客松,10 月旧金山开战 — PyTorch · 2026-09-25
- 网友推测 GPT 6 Luna/Sol 主打效率,意在配合 Cerebras 千 tok/s 推理 — brandon_galang · 2026-09-25