HyQuant:混合精度量化注意力,低比特下守住关键 token 精度
SJTU · hf · 2026-09-11
上海交大团队提出 HyQuant,针对 LLM 注意力层的低比特量化问题:保留关键的垂直线 token 与局部窗口的高精度,只量化其余部分,在低开销下维持模型精度。推理栈优化方向的实用工作。
「研究」频道最新
- PAPAV 框架综述:多模态具身智能体的感知-行动统一范式 — MikeShou1 · 2026-09-11
- 陶哲轩警告:AI 数学能力与网络攻击能力高度相关,风险非常真实 — sytelus · 2026-09-11
- 欧洲数学会发声:OpenAI 解 Navier-Stokes 是数学史金字塔,但模型不公开是隐忧 — i_dg23 · 2026-09-11
- AI 生成数学涌现,数学界需自建验证规范之争 — _sathvikr · 2026-09-11
- 阿里 RecGPT:三个 LLM 接入淘宝推荐,从拟合日志转向理解意图 — _reachsumit · 2026-09-11
- Meta 推出 Auto-RecSys:自主研究智能体跑多天级推荐系统实验 — _reachsumit · 2026-09-11