Liquid AI 发布 DSpark 草稿模型,推理提速 3 倍
JosephJacks_ · x · 2026-08-21
Liquid AI 发布了针对 LFM2.5 系列的 DSpark 草稿模型,采用推测解码技术,以极小的内存增加换取显著的解码速度提升,且不改变输出质量。
- 原理:轻量级草稿模型提议候选 token 块,目标模型在单次前向传播中验证。
- 性能:在 H100 上,LFM2.5-8B-A1B 在 MATH500 上的吞吐量提升至 3.18 倍(428 → 1362 tok/s);在 M4 Max MacBook Pro 上,1.2B 模型在 HumanEval 上提升 2.87 倍。
所属事件:Liquid AI 发布 DSpark 草稿模型,推理最高提速逾 3 倍(4 条相关)→
「模型」频道最新
- ForgeWM 渐进式训练高效视频世界模型 — ForgeWM · 2026-08-21
- 开发者警告:无审查Qwen 3.8 27B模型在Mac上直接教人制毒 — Polymarket · 2026-08-21
- 给编辑器加 Mermaid 功能,竟成模型能力试金石 — oran_ge · 2026-08-21
- ChatGPT 推出“首次恢复免费”的新功能? — PowerRangerDelSur · 2026-08-21
- 观点:Anthropic 新一代模型中,Fable 5 体验最佳 — bindureddy · 2026-08-21
- Anthropic 内部 AECI 指数:下一代模型提升极小 — ChrisGPT · 2026-08-21