腾讯 1.5TB 模型压至 200GB,精度几乎无损

ChrisGPT · x · 2026-08-29

腾讯宣布将 Hy4-preview 模型从 1.5TB 压缩至约 200GB GGUF 格式,且精度损失极小。该 MIX-STQ10 方法的核心在于利用校准数据为每一层动态决定位宽:部分层被激进压缩至 1.31-bit,而敏感层则保持在 2-bit 左右。

这种非均匀量化的策略在相同算力预算下显著降低了误差,展示了低比特推理的惊人效率。

所属事件:腾讯将 1.5TB 模型压缩至 200GB 且精度几乎无损(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →