别被 bf16 榜单骗了,我们需要真实量化评测

AuspiciousApple · reddit · 2026-08-18

作者指出 Qwen 等模型的 bf16 榜单成绩亮眼,但用户实际使用的是 4-bit 量化版,两者性能可能差异巨大。现有评测缺乏对不同量化格式(Q8/Q6/Q5 等)的系统对比,特别是针对长文本和复杂任务的误差分析。作者呼吁建立统一基准,测试同一模型在不同精度下的真实表现。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →