腾讯 Hy4 预览版通过 Sherry 量化缩至 214GB

alejandroll10 · x · 2026-09-02

腾讯宣布通过 Sherry 量化方法将 Hy4-preview 模型从 1.5TB 压缩至 214GB(约 7 倍缩减)。该方法将权重压缩至每位 1.25 比特,支持跨机器 GPU 拼接运行。基于 MIX-STQ10 技术,校准数据决定每层位宽,部分层低至 1.31-bit,部分至 2.06-bit。在 BF16 基准上,准确率损失极小:MCP Atlas (83.7→83.2), SWE-Bench (82.9→81.3)。模型及 GGUF 权重已发布。

所属事件:腾讯 Sherry 量化将 Hy4 预览版从 1.5TB 压至 214GB(5 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →