LiquidAI发布LFM2.5模型实现Mac端高速推理
LiquidAI 近日发布了专为智能体和编程工作流设计的 LFM2.5-2.6B 模型。该模型完全适配设备端本地运行,支持 128K 上下文。实测数据显示,在 M5 Max 芯片上,该模型预填充速度超过 1.1万 tok/s,解码速度达 82 tok/s,展现了 Apple Silicon 在本地 AI 推理方面的强大潜力。
2026-08-05 ~ 2026-08-05 · 2 条相关
- LiquidAI 新模型实测:Mac 本地跑 128K 上下文解码达 82 tok/s — helloiamleonie · 2026-08-05
- Nativ本地推理实测:LFM2.5在M5 Max上预填充超1.1万tok/s — helloiamleonie · 2026-08-05