Liquid 释出 QAD 量化模型,4-bit 精度达 97%
helloiamleonie · x · 2026-08-19
Liquid AI 发布了使用量化感知蒸馏 (QAD) 训练的新 4-bit 检查点,适用于 LFM2.5 系列 (230M 至 2.6B)。
技术细节:
- QAD 将高精度教师模型蒸馏为量化学生模型,以恢复因量化损失的精度。
- 新检查点保持了 Q40 格式的低内存占用和高解码吞吐量。
- 四个模型的平均精度恢复至 BF16 版本的约 97%。
开发者可直接替换现有的 Q40 GGUF 文件以获得更好的性能表现。
「Infra」频道最新
- 发布 Rust 二进制体积分析工具 cargo-bsize — charliermarsh · 2026-08-19
- 开放MAX并建立开放联盟,统一NVIDIA、AMD、Trainium等AI芯片 — clattner_llvm · 2026-08-19
- Higgsfield 选 Together AI 部署,依托专用容器推理 — togethercompute · 2026-08-19
- ModCon '26 收官:Mojo 正式开源,异构计算有了软件平台 — clattner_llvm · 2026-08-19
- Grok 4.6 登陆 Amazon Bedrock:500k 上下文、四档推理力度 — SpaceXAI · 2026-08-19
- vLLM+LMCache 生产实战:KV 缓存复用加速长上下文 Agent — Old_Ad_6033 · 2026-08-19