腾讯 Hy4 预览版:1.25bit 量化将体积缩减 7 倍

ccerrato147 · x · 2026-09-01

腾讯发布的 Hy4 模型预览版采用了名为 Sherry 的量化方法,将模型权重压缩至 1.25 bits,使得体积从 1.5TB 锐减至 214GB,且质量无明显损失。该技术还支持跨机器拼接 GPU,让多台设备的算力协同工作。目前 GGUF 量化版和原版模型均已提供下载。

所属事件:腾讯 Sherry 量化将 Hy4 模型压缩 7 倍至 214GB(4 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →