腾讯 Hy4 预览版:1.25bit 量化将体积缩减 7 倍
ccerrato147 · x · 2026-09-01
腾讯发布的 Hy4 模型预览版采用了名为 Sherry 的量化方法,将模型权重压缩至 1.25 bits,使得体积从 1.5TB 锐减至 214GB,且质量无明显损失。该技术还支持跨机器拼接 GPU,让多台设备的算力协同工作。目前 GGUF 量化版和原版模型均已提供下载。
所属事件:腾讯 Sherry 量化将 Hy4 模型压缩 7 倍至 214GB(4 条相关)→
「Infra」频道最新
- AWS 推出 AgentCore,不再强推全上云迁移 — DavidLinthicum · 2026-09-01
- Shopify 揭示持续学习循环:压缩失败至权重,成本降 96% — yenkel · 2026-09-01
- Shopify 工程师详解 GraphQL Agent 的持续学习实践 — Drewch · 2026-09-01
- 推理厂商 Wafer 拒收购募资 4000 万美元,估值超 2 亿 — steph_palazzolo · 2026-09-01
- x402 标准:为智能体经济构建原生支付层 — kleffew94 · 2026-09-01
- 定制 HBM 可将 LLM 推理速度提升 5 倍 — BenBajarin · 2026-09-01