Unsloth 发布 Qwen2.5-72B 新量化模型:1-bit 版仅需 8GB 显存

cephaloform · x · 2026-08-20

Unsloth AI 发布了针对 Qwen2.5-72B 的新 GGUF 量化模型。其动态 V3 版本在 Div-300、KLD 等基准测试中准确率提升超 10%。最引人注目的是,团队同时发布了 1-bit 极致量化版本,仅需 8GB 内存即可运行,且保留了约 77% 的 BF16 精度性能。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →