Liquid AI 发布 DSpark 草稿模型,提速最高 3.18 倍
JosephJacks_ · x · 2026-08-21
Liquid AI 为 LFM2.5 系列发布了 DSpark 草稿模型(约 3 亿参数),采用投机解码技术。通过小模型提议、大模型验证的机制,在 H100 上实现了最高 3.18 倍的解码加速(MATH500 数据集),在 M4 Max 上加速达 2.87 倍。该技术仅在贪婪解码下保持输出完全一致,不改变模型精度,目前已获 llama.cpp 和 SGLang 支持。
所属事件:Liquid AI 发布 DSpark 草稿模型,LFM2.5 解码提速最高 3.18 倍(5 条相关)→
「Infra」频道最新
- 阿里 Ghodsi 回忆:2010 年全带宽网络如何催生存算分离 — matei_zaharia · 2026-08-21
- 搭建 Beelink 服务器远程管理项目的体验 — viksit · 2026-08-21
- GPU Mode 推出 100+ 节 CUDA 与内核优化实战课 — blaizedsouza · 2026-08-21
- Cloudera 联手英伟达:Spark 4.1 获 GPU 加速提速 4 倍 — shashib · 2026-08-21
- 太空建数据中心难逃监管:火箭发射亦受各州限制 — wordgrammer · 2026-08-21
- 单兵年入 600 万美元,Morph 冲击 10 人百亿估值 — ycombinator · 2026-08-21