腾讯 Hy4 预览版通过 Sherry 量化缩至 214GB
alejandroll10 · x · 2026-09-02
腾讯宣布通过 Sherry 量化方法将 Hy4-preview 模型从 1.5TB 压缩至 214GB(约 7 倍缩减)。该方法将权重压缩至每位 1.25 比特,支持跨机器 GPU 拼接运行。基于 MIX-STQ10 技术,校准数据决定每层位宽,部分层低至 1.31-bit,部分至 2.06-bit。在 BF16 基准上,准确率损失极小:MCP Atlas (83.7→83.2), SWE-Bench (82.9→81.3)。模型及 GGUF 权重已发布。
所属事件:腾讯 Sherry 量化将 Hy4 预览版从 1.5TB 压至 214GB(5 条相关)→
「模型」频道最新
- Meta发布实时语音模型Muse,支持20人说话人分离 — bowenc0221 · 2026-09-02
- Atlas 架构揭秘:多模态自回归扩散 Transformer 从零预训练 — theworldlabs · 2026-09-02
- World Labs 发布空间智能全模态世界模型 Atlas,将开放早期访问 — theworldlabs · 2026-09-02
- Fable 5.1 现身 Claude 官方支持文档,发布在即 — kimmonismus · 2026-09-02
- Meta 发布 Muse Voice Transcribe:支持 20+ 人声分离 — AIatMeta · 2026-09-02
- Muse Voice Transcribe:自适应延迟平衡速度与精度 — AIatMeta · 2026-09-02