GLM-5.3 登顶 EQ-Bench v4,分析能力得分罕见达 9.1

airesearch12 · x · 2026-08-19

EQ-Bench v4 基准测试结果显示,Zaiorg 的 GLM-5.3 取得极其积极的成果,以较大幅度超越此前开源冠军 K3 及 Fable 等最强商业模型。GLM-5.3 被定义为“直接分析师”人格,而非“和谐寻求者”或“讨好者”。其分析得分高达 9.1,但也因过于机器化而引发讨论。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →