DeltaTensors 给微调模型做增量存储:953MB 压到 294MB
cupheadgamer · reddit · 2026-09-22
开源工具 DeltaTensors 像 Git 一样管理模型微调版本,但只存相对基座模型的权重差值而非完整副本。多个微调/checkpoint 只需保留一份基座,每个版本存一个更小的 .wdelta 文件。
- 实测:Qwen2.5-0.5B 的一个微调从 953MB 压到 294MB,重建后困惑度从 19.11 变为 19.22。
- 训练后处理即可,无需改用 LoRA 或改变微调方式,已有全量微调可直接压缩。
- 支持链式增量做版本历史、Hugging Face Trainer checkpoint,以及流式压缩/重建,不必同时加载两个完整模型。
仓库:AaravGaurdev/deltatensors。
「Infra」频道最新
- 本地 Qwen 27B Agent 接管亚马逊账号,一次跑通自动买纸 — fuzhongkai · 2026-09-22
- CBS 60分钟:高尔夫球场用水是数据中心的2倍多 — SumitGup · 2026-09-22
- R9700+Strix Halo 实测:ROCm 仍领先 DeepSeek,Vulkan 追近差距 — Hrethric · 2026-09-22
- 阿里巴巴发布新 AI 芯片,称其为中国最强 — AIFlow_ML · 2026-09-22
- DGX Spark 本地跑编程模型:该用什么量化与工具链? — be566 · 2026-09-22
- Intel 为 Qwen-Image-2.1 提供首日 OpenVINO 优化支持 — Alibaba_Qwen · 2026-09-22