腾讯 Sherry 量化法将 Hy4 模型缩减 7 倍

QuixiAI · x · 2026-09-01

腾讯推出的 Sherry 量化方法可将模型权重压缩至 1.25 bits。在 Hy4 Preview 模型上,该方法将体积从 1.5TB 减至 214GB,且仅造成极小的精度损失(如 MCP Atlas 从 83.7 降至 83.2)。该方法还支持跨机器 GPU 拼接运行。

所属事件:腾讯 Sherry 量化技术将混元 Hy4 模型压缩七倍至 214GB(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →