腾讯 Sherry 量化法将 Hy4 模型缩减 7 倍
QuixiAI · x · 2026-09-01
腾讯推出的 Sherry 量化方法可将模型权重压缩至 1.25 bits。在 Hy4 Preview 模型上,该方法将体积从 1.5TB 减至 214GB,且仅造成极小的精度损失(如 MCP Atlas 从 83.7 降至 83.2)。该方法还支持跨机器 GPU 拼接运行。
所属事件:腾讯 Sherry 量化技术将混元 Hy4 模型压缩七倍至 214GB(3 条相关)→
「研究」频道最新
- SWE-bench 推出多模态评测基准,斯坦福与 Meta 联合开发 — jyangballin · 2026-09-01
- SWE-bench Multimodal v2发布:480个视觉编程任务,开源 — jyangballin · 2026-09-01
- SWE-bench Multimodal v2发布:480个视觉编程任务 — jyangballin · 2026-09-01
- 机器人视觉新基准InFlux++:动态相机内参预测数据集 — cindy_x_wu · 2026-09-01
- Gemini 3.7 Flash多智能体攻克7项数学难题并自研CPU模拟器 — Dr_Singularity · 2026-09-01
- AllenAI 总结 AI 推动科学进步的五个关键方向 — allen_ai · 2026-09-01