腾讯将 1.5TB 模型压至 200GB,通过分层校准保精度

ChrisGPT · x · 2026-08-29

腾讯展示了惊人的模型压缩效率,将 Hy4 preview 从 1.5TB 压缩至 200GB 且基准测试几乎不受影响。其核心创新在于利用校准数据动态决定每一层的压缩强度:不敏感层被激进压缩至 1.31 bit,而敏感层则保持在约 2 bit,从而在体积缩减的同时防止模型崩塌。这种基于层敏感度的差异化量化策略实现了极高的效率提升。

所属事件:腾讯将 1.5TB 模型压缩至 200GB 且精度几乎无损(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →