腾讯将 1.5TB 模型压缩至 200GB 且精度几乎无损
腾讯宣布将 Hy4-preview 模型从 1.5TB 压缩至约 200GB 的 GGUF 格式,基准测试表现几乎不受影响。其核心方法 MIX-STQ10 利用校准数据为每一层动态决定压缩强度:对不敏感的层施以更高压缩,敏感层则保留更多精度,从而在大幅缩小体积的同时将精度损失控制在极小范围内。
2026-08-29 ~ 2026-08-29 · 2 条相关
- 腾讯 1.5TB 模型压至 200GB,精度几乎无损 — ChrisGPT · 2026-08-29
- 腾讯将 1.5TB 模型压至 200GB,通过分层校准保精度 — ChrisGPT · 2026-08-29