网友想把 1.25bit 量化方案搬到 Qwen3.8-Flash-Next
TemperatureOk3561 · reddit · 2026-08-31
Reddit 用户发帖询问:看到 HY4 用 1.25 bit 量化从 1.5TB 压到约 200GB 且 benchmark 保留率高达 98%(有配套论文),是否值得把同样方法用于 Qwen3.8-Flash-Next,以及作为个人项目是否规模过大。作者坦言自己常低估项目难度,想先听取社区反馈再动手。
「Infra」频道最新
- 独家:SK海力士拟将HBM4E基础裸片部分外包英特尔代工 — BenBajarin · 2026-08-31
- 月费 200 美元却让 OpenAI 月亏 1.4 万,真事改编 — BuildersReadOnAI · 2026-08-31
- 实战:测量 Windows 应用对 Agent 暴露的控件树 — Frequent-Ad-836 · 2026-08-31
- Rayrun 推出 sPTC 技术,AI 响应速度提升 20% — lucgagan · 2026-08-31
- 三星 HBM4 领跑,SK 海力士/美光遇阻 — AccBalanced · 2026-08-31
- R9V:RDNA4 定制内核跑 Qwen3.8 吞吐量提升 30 倍实测 — Public_Umpire_1099 · 2026-08-31