开发者呼吁将量化感知训练设为开源模型发布标准
MADxMORON · reddit · 2026-09-02
一位开发者在 Reddit 发起讨论,质疑为何量化感知训练(QAT)尚未成为开源模型发布的常态。他指出,社区几乎会在发布当天将模型量化至 4bit 以便运行,与其后期量化,不如在训练阶段就引入 QAT。发帖人询问这是否是因为训练成本增加、影响基准测试分数,还是相比后训练量化收益有限,呼吁行业重新考虑这一实践。
「Infra」频道最新
- 双 5060Ti 开启 P2P 失败:主板 PCIe 陷阱 — chocofoxy · 2026-09-02
- SB Energy 拟上市:半年收 1.4 亿亏损 32 亿,积压 439 亿 — VraserX · 2026-09-02
- 入手 6279 美元 RTX 5090 整机,是否踩雷? — Sexyvette07 · 2026-09-02
- DARPA 曾造 18 亿像素 ARGUS 摄像头,日拍 100 万 TB — aakashgupta · 2026-09-02
- 隐私与自由:5 种在本地运行 LLM 的主流方案 — goyalshaliniuk · 2026-09-02
- LLM 编程推理负载呈三峰趋势,周五降 20% — jwt0625 · 2026-09-02