Liquid AI 2.6B 模型实测:端侧跑速达 90t/s,工具调用翻车

curiousily_ · reddit · 2026-08-06

开发者在 M5 Pro 上使用 llama.cpp 实测了 Liquid AI 推出的 LFM2.5(2.6B 稠密模型)。在 Q8 量化下,该模型跑出了约 90 tokens/s 的速度,内存占用仅约 4GB,展现了优秀的端侧部署效率。

然而,在智能体任务(工具调用和推理)的实测中,LFM2.5 表现不佳。与官方基准测试中的竞争对手——Q4 量化的 Qwen3.5 4B 相比,LFM2.5 在工具调用方面严重落后。在 OpenCode 环境中,它不仅难以正确发起工具调用,甚至对当前工作目录的认知也存在明显混乱。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →