激活感知量化提升 GPQA 准确率,但也拖慢 Gemma 3 4B QAT
devildip · reddit · 2026-07-21
* 发帖者在测试 **activation-aware quantization**,发现一个明显权衡:**精度提升** 的同时,**吞吐下降**。 * 在 **GPQA** 上、使用 **Gemma 3 4B QAT** 时,测试组达到了 **27.8% 准确率 / 331ms**,对照组则是 **23.2% / 256ms**。 * 这条帖子的重点是工程取舍:如果只能选一个,你会要更快的量化,还是更准的量化?
「研究」频道最新
- 按任务路由比单一最佳模型高出 15 个点 — ZainHasan6 · 2026-07-21
- PolicyTrim 让 VLA 机器人少走弯路,执行速度最高提 5.83 倍 — 新智元 · 2026-07-21
- 《黑客帝国》梗回击 LLM 解题争论:信念与资源同样关键 — prasanna_says · 2026-07-21
- 更多算力会显著提升前沿模型的网络攻防表现 — peterwildeford · 2026-07-21
- 论文称随机探索可修复 3DGS 两类优化瓶颈 — zhenjun_zhao · 2026-07-21
- SSR 用稀疏体素迭代细化单目几何 — zhenjun_zhao · 2026-07-21