网友排最新大模型梯队:GLM-5.2 介于 Qwen 与 GPT 之间
scaling01 · x · 2026-08-13
有博主分享了其综合能力与可用性后的最新大模型排名梯队,并指出 GLM-5.2 的实力大致介于 Qwen 3.8 和 GPT-5.3-Codex 之间。
在其个人排名中,当前前沿模型被划分为多个层级:
- T0 竞争前沿:GPT-6 Astra 与 Mythos 5.1 领跑。
- T1 顶级梯队:包含 Mythos 5、GPT-5.6-Sol 与 Opus 5。
- T2 主流强模型:GPT-5.5、Opus 4.8,以及 Kimi-K3、GPT-5.4、Qwen 3.8、Grok 4.6 和 DeepSeek-V4-Pro 等同处一层。
他强调,目前公众可见的模型与真正的最前沿(actual frontier)之间仍存在巨大鸿沟。
「模型」频道最新
- 从智力到性价比:大模型核心评估指标的演进路线 — beffjezos · 2026-08-13
- DeepSeek与Grok新模型推动AI成本暴跌,引发杰文斯悖论 — R_D · 2026-08-13
- Grok 4.6 首日体验:超越开源模型,稳居前三 — bindureddy · 2026-08-13
- 首个成功绕过 Pangram 4 检测的 AI 文本人性化模型发布 — ctjlewis · 2026-08-13
- 同任务同模型,Kimi K3 在不同 Agent 框架下成本差 10 倍 — thursdai_pod · 2026-08-13
- 开发者吐槽:Anthropic 新版 Opus 5 默认设置致用户体验下降 — rickasaurus · 2026-08-13