LiquidAI发布LFM2.5模型实现Mac端高速推理

LiquidAI 近日发布了专为智能体和编程工作流设计的 LFM2.5-2.6B 模型。该模型完全适配设备端本地运行,支持 128K 上下文。实测数据显示,在 M5 Max 芯片上,该模型预填充速度超过 1.1万 tok/s,解码速度达 82 tok/s,展现了 Apple Silicon 在本地 AI 推理方面的强大潜力。

2026-08-05 ~ 2026-08-05 · 2 条相关