ComfyUI 无损压缩节点:28GB 模型压到 19GB,位级完全一致
New-Shift6661 · reddit · 2026-09-24
一位开发者发布了首批 ComfyUI 节点 ComfyUI-LosslessCompression,可对 AI 模型文件做无损压缩,且压缩后权重逐位与原文件一致,支持 fp32/fp16/bf16/fp8 等各种 dtype,推理结果与原模型完全相同。
核心是 LLC 压缩:训练好的权重中符号位和尾数位近乎随机、无法压缩,只有指数位有规律可循。工具原样保存符号位与尾数位,对每个张量的指数位做短编码,压缩率距理论极限仅 1-2 个百分点——例如 28GB 的 bf16 模型可压到约 19GB。使用上在 ComfyUI 新建标签页,选择要压缩的模型点 RUN 即可,耗时与模型大小成正比。
项目地址:GitHub - GDI-Forces/ComfyUI-LosslessCompression
「Infra」频道最新
- 一条 prompt 让 agent 自己核算账单:价格涨还是用量涨? — gethackteam · 2026-09-24
- 内核启动 50μs 延迟的代价:通用推理框架难以复刻单模型专有优化 — AlpinDale · 2026-09-24
- 腾讯混元扩展 critical-batch-size 理论:GRPO 训练提速 29%,PPO 生成吞吐达 2.29× — TencentHunyuan · 2026-09-24
- 小米披露MiMo-V3架构HySparse2:KV Cache占用降至约1/4.5 — 智东西 · 2026-09-24
- NVIDIA 直播:DGX Spark/Station 本地跑 Nemotron 3.5 Lightning — NVIDIA Developer · 2026-09-24
- 跑 LLM 别只看核心数:AMD CCD 数量决定带宽上限 — HankYeomans · 2026-09-24