质疑测评:量化或致 GLM 视觉性能受损
Sentdex · x · 2026-08-31
Sentdex 针对 GLM 5.3 Flash 的糟糕测评结果提出质疑,怀疑评测者使用了量化版本,从而损害了模型的视觉性能。他指出实际体验与评测数据存在偏差,并正在寻找未标记的原始图片进行独立验证。
「模型」频道最新
- 用户对比体验:Grok 4.6 可读性远超 Opus 5 — morganb · 2026-08-31
- 实测:Claude 视频 768p 生成秒杀 Gemini 宣称的 5 秒/帧 — RADIO02118 · 2026-08-31
- Claude 拒绝在输入中处理脏话 — lxrjl · 2026-08-31
- Sentdex 复现 GLM 5.3 评测异常:全精度本地运行 — Sentdex · 2026-08-31
- 用户吐槽 Qwen 3.8 可读性下降,充斥符号与晦涩表达 — parepeg · 2026-08-31
- PhoneLLM 实测:P95 延迟低于 600ms,每分钟成本约 0.25 美分 — altryne · 2026-08-31