腾讯将 1.5TB 模型压缩至 200GB 且精度几乎无损

腾讯宣布将 Hy4-preview 模型从 1.5TB 压缩至约 200GB 的 GGUF 格式,基准测试表现几乎不受影响。其核心方法 MIX-STQ10 利用校准数据为每一层动态决定压缩强度:对不敏感的层施以更高压缩,敏感层则保留更多精度,从而在大幅缩小体积的同时将精度损失控制在极小范围内。

2026-08-29 ~ 2026-08-29 · 2 条相关