腾讯将 Hy4-preview 从 1.5TB 压缩至 200GB GGUF
RedditUsr2 · reddit · 2026-08-29
据 Reddit 用户分享,腾讯成功将 Hy4-preview 模型从原始的 1.5TB 压缩至约 200GB 的 GGUF 格式,并且保持了约 98% 的性能表现。这一大幅度的压缩显著降低了模型对存储资源的需求。
所属事件:腾讯将 1.5TB 模型压缩至 200GB 且性能几乎无损(3 条相关)→
「Infra」频道最新
- 树莓派 Zero 实现 27.8 FPS 深度处理 — yacineMTB · 2026-08-29
- Mac Studio M5 Ultra 本地运行 320B 模型仅需两万美分之一成本 — SumitGup · 2026-08-29
- 模型太强也是灾难:Google TPU 起源于语音识别推理算力瓶颈 — demian_ai · 2026-08-29
- 16GB 显卡本地部署视频生成模型技巧 — mxjxn · 2026-08-29
- RTX 5070 单卡实测 Qwen3.8 极致量化:12GB 显存跑出 22t/s — jacek2023 · 2026-08-29
- 16GB 显卡本地部署视频生成模型技巧 — PurzBeats · 2026-08-29