LFM2.5-DSpark 推理提速 3.2 倍,GGUF 版本已发布

pmttyji · reddit · 2026-08-21

作者分享了 LFM2.5-DSpark 模型在 Speculative Decoding(投机解码)下的性能提升,据称推理速度最高可达 3.2 倍。相关 PR 已合并,官方 GGUF 版本已上线 Hugging Face,涵盖 1.2B、2.6B 和 8B 等多个尺寸。作者同时提醒不要使用 PR 中的测试版 GGUF,并询问在移动端运行该方案的方法。

所属事件:LiquidAI LFM2.5-DSpark 借投机解码提速 3.2 倍,GGUF 版发布(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →