Liquid AI 推出 DSpark 草稿模型,加速达 4 倍
JosephJacks_ · x · 2026-08-21
Liquid AI 发布了针对 LFM2.5 系列的 DSpark 草稿模型,通过投机解码技术大幅提升推理速度。
- 核心原理:利用轻量级草稿模型提议候选 token,目标模型在单次前向传播中验证,以少量显存增加换取巨大速度提升。
- 性能数据:
- H100 上:LFM2.5-8B-A1B 在 MATH500 上吞吐量从 428 提升至 1362 tok/s(约 3.18 倍)。
- 端侧(M4 Max):LFM2.5-1.2B-Instruct 在 HumanEval 上从 136 提升至 389 tok/s(约 2.87 倍)。
- LFM2.5-2.6B 在 H100 上达 2.67 倍加速。
- 适用场景:特别适合端侧函数调用应用或云端对延迟敏感的负载。
所属事件:Liquid AI 发布 DSpark 草稿模型,推理提速最高超 3 倍(2 条相关)→
「模型」频道最新
- 为何「全通过率」是个糟糕的评测指标? — xeophon · 2026-08-21
- ARC Prize 上线模型对比功能,Gemini 3.7 Flash 曝光高分 — mhmazur · 2026-08-21
- Anthropic Fable 放宽过滤后刷新 RareBench 记录 — danielmckinn0n · 2026-08-21
- NVIDIA 详解 Omni-Model:单一架构通吃文本图像视频与动作 — NVIDIA Developer · 2026-08-21
- 监测显示 Claude Opus 近期行为出现显著变化 — altryne · 2026-08-21
- 用户反馈 GPT-4.1 Sol 模型突然变笨,回答质量显著下降 — M-M103 · 2026-08-21