GLM 5.3 Flash表现引争议,量化版本疑背锅
智谱 GLM 5.3 Flash 模型的评测结果引发争议。有开发者通过 OpenRouter API 重新测试,发现模型在不同思考水平下表现糟糕,甚至比之前评测更差。Sentdex 对此质疑,半开玩笑称 OpenRouter 又在"精准打击",怀疑评测者使用了量化版本导致视觉性能受损,并在本地全精度运行以复现问题,同时寻找未标记的原始模型验证实际体验与评测数据的偏差。
2026-08-31 ~ 2026-08-31 · 3 条相关
- 质疑测评:量化或致 GLM 视觉性能受损 — Sentdex · 2026-08-31
- 开发者实测:GLM 5.3 Flash 表现甚至变差了 — skalskip92 · 2026-08-31
- Sentdex 复现 GLM 5.3 评测异常:全精度本地运行 — Sentdex · 2026-08-31