LiquidAI 新模型实测:Mac 本地跑 128K 上下文解码达 82 tok/s
helloiamleonie · x · 2026-08-05
LiquidAI 发布了专为智能体和编程工作流设计的 LFM2.5-2.6B 模型。该模型支持 128K 上下文,且完全适配设备端本地运行。\n\n在 M5 Max(48GB)设备上使用本地推理工具 Nativ(无量化 bf16 精度)进行实测,该模型展现出优异的性能:预填充速度达 11,231 tok/s,解码速度达 82 tok/s。同时,跑满 128K 上下文仅占用 8.5GB 内存,在 batch 16 的聚合解码下可达 476 tok/s。
所属事件:LiquidAI新模型实测Mac本地推理性能强劲(3 条相关)→
「Infra」频道最新
- 阶跃 Step 5 Preview 评测 44 分,成本仅同级模型 1/2.8 — ArtificialAnlys · 2026-09-22
- SemiAnalysis 抢先拆解 A20:A20 基于 TSMC N2,封装内藏 DRAM — dylan522p · 2026-09-22
- Bernstein 英特尔调研:服务器芯片 2027 年前供不应求,真正考验在 2028 — BenBajarin · 2026-09-22
- rollout 调度成推理效率杠杆,网友热议论文公开指标 — stochasticchasm · 2026-09-22
- 爆料称 Grok 数据中心出现故障事故 — Daniel_Farinax · 2026-09-22
- 网友拆解某前沿实验室 infra:解耦 agent 运行时与沙箱设计 — stochasticchasm · 2026-09-22