网友想把 1.25bit 量化方案搬到 Qwen3.8-Flash-Next

TemperatureOk3561 · reddit · 2026-08-31

Reddit 用户发帖询问:看到 HY4 用 1.25 bit 量化从 1.5TB 压到约 200GB 且 benchmark 保留率高达 98%(有配套论文),是否值得把同样方法用于 Qwen3.8-Flash-Next,以及作为个人项目是否规模过大。作者坦言自己常低估项目难度,想先听取社区反馈再动手。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →