LiquidAI 推出 QAD 量化技术,4-bit 模型保留 97% 性能
JosephJacks_ · x · 2026-08-20
LiquidAI 发布了针对 LFM2.5 系列模型的更新 4-bit 检查点,使用了量化感知蒸馏 (QAD) 技术。
- 性能表现:在保持 Q40 格式的低内存占用和高解码吞吐量的同时,四个检查点均恢复了约 97% 的 BF16 平均性能。
- 实测体验:开发者分享了运行 2.6B 模型的具体命令 (llama-server),支持 131k 上下文,参数包括 temp 0.1、top-k 50 等,表示效果良好且资源占用低。
所属事件:Liquid AI 发布 QAD 量化模型,4-bit 保留 97% 性能(2 条相关)→
「Infra」频道最新
- Qwen3.8-27B 实测:KV Cache 量化至 Q4 显著影响思维质量 — fbms2 · 2026-08-20
- DGX Spark 带宽受限,博主权衡用 RTX 5090 提速 — daniel_mac8 · 2026-08-20
- 延迟 1.5 年损毁 8.9% 价值,AI 数据中心速度为王 — Beth_Kindig · 2026-08-20
- 澄清:OpenAI 20% 算力用于监测是误解 — sjgadler · 2026-08-20
- SkyPilot 联手 VAST Data 等举办 AI 基础设施聚会 — skypilot_org · 2026-08-20
- PolymathicAI 发布 15TB 物理模拟数据集 The Well — tom_doerr · 2026-08-20