Liquid AI 发布量化感知蒸馏技术,Q4 模型保留 97% 性能

alexcovo_eth · x · 2026-08-20

Liquid AI 发布了新的量化方法 Quantization-Aware Distillation (QAD),通过让模型在训练过程中体验 4-bit 量化误差并由高精度模型指导,使其学会补偿精度损失。该方法应用于 LFM2.5 系列(230M-2.6B)模型后,生成的 Q40 GGUF 模型在保持低内存占用的同时,保留了约 97% 的 BF16 原始性能。

所属事件:Liquid AI 推出 QAD 量化技术,4-bit 模型保留 97% 性能(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →