腾讯 Sherry 量化将 Hy4 模型压缩 7 倍至 214GB
腾讯混元团队发布 AngelSlim 量化方案及 Hy4 Preview 轻量版:自研 Sherry 量化方法将模型权重压缩至 1.25 bits,配合 MIX-STQ1.0 混合精度策略,使模型体积从 1.5TB 锐减至 214GB,权重压缩约 85%,质量与性能基本持平,并支持异构协同,大幅降低硬件门槛。
2026-09-01 ~ 2026-09-01 · 4 条相关
- 腾讯混元 AngelSlim:Hy4 模型压缩至 214GB 并支持异构协同 — 腾讯混元 · 2026-09-01
- 腾讯混元推轻量版:权重压缩 85%,性能持平 — 智东西 · 2026-09-01
- 腾讯 Sherry 量化法将 Hy4 模型缩减 7 倍 — QuixiAI · 2026-09-01
- 腾讯 Hy4 预览版:1.25bit 量化将体积缩减 7 倍 — ccerrato147 · 2026-09-01