Liquid AI 发布 2.6B 端侧模型:手机跑 30 tok/s
BTA_Labs · reddit · 2026-08-05
Liquid AI 发布了 LFM2.5-2.6B 模型,主打端侧运行。该模型仅 2.69B 参数,支持 128K 上下文及工具调用,专为多步 Agent 工作流优化。
性能表现(官方数据):
- 手机端速度达 30 tok/s,M5 Max 达 220 tok/s。
- 内存占用低于 2.5 GB,Q4 量化版仅 1.67 GB。
能力评测:
- 在工具调用上具备竞争力,但编码和重度知识任务仍弱于大模型。
- 官方明确表示不建议用于 Agent 编码。
作者认为,这类小模型的最佳定位是作为本地 worker agent 执行提取、搜索等重复性工具调用,遇到复杂规划时再交由大模型处理。
所属事件:Liquid AI 发布 LFM2.5-2.6B 端侧智能体模型(12 条相关)→
「Infra」频道最新
- 自优化智能体提升B200推理吞吐量16%且不损精度 — yisongyue · 2026-08-05
- 逆向工程:逐位精确模拟英伟达 Blackwell 张量核心 — ycombinator · 2026-08-05
- AI 编码瓶颈不在模型,而在测试与 CI 流水线 — hichaelmart · 2026-08-05
- xAI 宣布建设第四座数据中心,配备 22 万块 GB300 — chrisgrayson · 2026-08-05
- 告别云端重配环境:本地大模型持久化 GPU 桌面算力经济账分析 — ievseev · 2026-08-05
- 图分析基准 Graph500 入选 SPEC CPU 2026 处理器测试套件 — Prof_DavidBader · 2026-08-05