LiquidAI LFM2.5-DSpark 借投机解码提速 3.2 倍,GGUF 版发布

LiquidAI 发布了 LFM2.5-1.2B-Instruct-DSpark 模型的 GGUF 版本,该模型参数量 1.2B,基于 LFM2.5 架构,专为文本生成任务优化。作者分享其在投机解码(Speculative Decoding)下的性能表现,推理速度最高可达 3.2 倍提升,相关 PR 已合并,官方 GGUF 版本现已可用。

2026-08-19 ~ 2026-08-21 · 2 条相关