腾讯混元 1.25-bit 模型落地 B 站直播翻译

腾讯混元 · wechat · 2026-08-26

腾讯混元发布针对端侧翻译模型 Hy-MT2-1.8B 的极致量化方案,成功将 3.3GB 模型压缩至 440MB(1.25-bit)或 574MB(2-bit),且翻译质量几乎无损。

技术方案:

落地与优化:

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →