实测显示 GLM 5.3 Flash 视觉能力较弱
bhq322 · x · 2026-08-30
skalskip92 的对比测试显示,GLM 5.3 Flash 在视觉任务(如航拍与卫星图像分析)中表现糟糕,与其他模型存在明显差异。不同模型在编码和视觉能力上的分化显著,目前尚无 AGI 迹象。
「模型」频道最新
- 用户对比体验:Grok 4.6 可读性远超 Opus 5 — morganb · 2026-08-31
- 实测:Claude 视频 768p 生成秒杀 Gemini 宣称的 5 秒/帧 — RADIO02118 · 2026-08-31
- Claude 拒绝在输入中处理脏话 — lxrjl · 2026-08-31
- Sentdex 复现 GLM 5.3 评测异常:全精度本地运行 — Sentdex · 2026-08-31
- 用户吐槽 Qwen 3.8 可读性下降,充斥符号与晦涩表达 — parepeg · 2026-08-31
- PhoneLLM 实测:P95 延迟低于 600ms,每分钟成本约 0.25 美分 — altryne · 2026-08-31