GLM 5.3 Flash表现引争议,量化版本疑背锅

智谱 GLM 5.3 Flash 模型的评测结果引发争议。有开发者通过 OpenRouter API 重新测试,发现模型在不同思考水平下表现糟糕,甚至比之前评测更差。Sentdex 对此质疑,半开玩笑称 OpenRouter 又在"精准打击",怀疑评测者使用了量化版本导致视觉性能受损,并在本地全精度运行以复现问题,同时寻找未标记的原始模型验证实际体验与评测数据的偏差。

2026-08-31 ~ 2026-08-31 · 3 条相关