玩家自制 RCO-lite 动态量化:一半 KLD 误差,比 IQ3_M 还小 52MB

jjusko20 · reddit · 2026-10-08

Reddit 用户分享自研的「穷人版 RCO」动态量化方法 v1:不发明新数学,而是用廉价近似复现 IST Austria RCO 的核心思想——在字节预算下按张量选精度,优化整模型任务 KL 散度。

流程:

Qwen 3.5 2B 早期结果:

作者坦承预计打不过 GSQ-RCO 和 Unsloth Dynamic V3,但方法便宜、省显存、伪算法已文档化可复现。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →