Liquid AI 发布 DSpark 草稿模型,LFM2.5-VL-3B 推理最高提速 3.13 倍
helloiamleonie · x · 2026-09-25
Liquid AI 为视觉语言模型 LFM2.5-VL-3B 发布实验性 DSpark 草稿模型,引入投机解码:轻量 drafter 提前提出多个 token,目标模型一次前向验证,在不改变输出质量的前提下加速生成。
在六类视觉语言任务、batch size 1、temperature 0 的测试中:
- M5 Max 上 MLX:解码最高提速 3.13 倍,端到端 2.62 倍
- M3 Ultra 上 llama.cpp:解码最高 2.14 倍,端到端 1.77 倍
- H100 上 SGLang:解码最高 2.66 倍,端到端 2.27 倍
权重已在 Hugging Face 开放,MLX-VLM 生态实现 day-0 支持。
所属事件:Liquid AI 推出 DSpark 投机解码,VL 模型提速超 3 倍(4 条相关)→
「Infra」频道最新
- AI 找 Linux 漏洞太快,Ubuntu 被迫转向每周内核更新 — AIFlow_ML · 2026-09-25
- Wasmer 在 iOS 和浏览器跑起 PostgreSQL 18.4,全程无需后端 — jedisct1 · 2026-09-25
- 推理服务商 Jatevo:已交付 1240 亿 token、166 万次请求、14.7 万美元推理 — toptickcrypto · 2026-09-25
- 免校准量化方法 TQ 开源:4-bit 量化 Qwen3.8-27B 即发即用 — textclf · 2026-09-25
- Ben Bajarin:Agent 推理重塑数据中心 CPU/GPU 配比,neocloud 落后 hyperscaler — BenBajarin · 2026-09-25
- PreFT 论文入选 NeurIPS:仅 Prefill 阶段用 LoRA,多适配器推理提速 — aryaman2020 · 2026-09-25