Liquid AI 发布 DSpark 推理加速,吞吐提升 3 倍
JosephJacks_ · x · 2026-08-21
Liquid AI 发布了 LFM2.5 系列的 DSpark draft 模型,引入推测解码路径。该方法通过轻量级模型提出候选 token,再由主模型一次前向传播验证,仅增加少量内存即可大幅提升解码速度。实测显示,在 H100 上吞吐量最高提升 3.18 倍,在 M4 Max 上提升 2.87 倍,且不改变输出质量。
所属事件:Liquid AI 发布 DSpark 草稿模型,推测解码加速最高 4 倍(3 条相关)→
「Infra」频道最新
- AI 模型路由难题:不仅要无缝切换,更要懂何时去哪 — BenBajarin · 2026-08-21
- 算力沙盒初创 Targon 月收入增长 3.5 倍 — markjeffrey · 2026-08-21
- 北卡小镇 Spruce Pine 掌控英伟达关键石英供应链 — seanmcdonaldxyz · 2026-08-21
- 民调:美民众反对本地数据中心比例飙升至 75% — Polymarket · 2026-08-21
- Ramp Router 宣布 GPT-5.6 Sol 推理价格减半 — KlausCodes · 2026-08-21
- NVIDIA 发布官方 CUDA MCP 服务器,辅助 GPU 代码编写与性能分析 — swagonflyyyy · 2026-08-21