开发者实测:GLM 5.3 Flash 表现甚至变差了
skalskip92 · x · 2026-08-31
开发者通过 OpenRouter API 对智谱 GLM 5.3 Flash 模型进行了重新评估。测试结果显示,在不同思考水平下,该模型的表现“看起来很糟糕”,甚至比之前的评测结果还要差。该开发者怀疑模型后台可能发生了变动,计划再次进行验证。
所属事件:GLM 5.3 Flash 评测引争议 开发者实测表现变差(2 条相关)→
「模型」频道最新
- 用户对比体验:Grok 4.6 可读性远超 Opus 5 — morganb · 2026-08-31
- 实测:Claude 视频 768p 生成秒杀 Gemini 宣称的 5 秒/帧 — RADIO02118 · 2026-08-31
- Claude 拒绝在输入中处理脏话 — lxrjl · 2026-08-31
- Sentdex 复现 GLM 5.3 评测异常:全精度本地运行 — Sentdex · 2026-08-31
- 用户吐槽 Qwen 3.8 可读性下降,充斥符号与晦涩表达 — parepeg · 2026-08-31
- PhoneLLM 实测:P95 延迟低于 600ms,每分钟成本约 0.25 美分 — altryne · 2026-08-31