GLM-5.3 强势冲上 Terminal-Bench 3.0,逼近 Fable 5
scaling01 · x · 2026-08-20
有用户实测发现,智谱 GLM-5.3 在终端任务基准 Terminal-Bench 3.0 上表现强劲,成绩已接近 Fable 5,几乎与之持平。
所属事件:GLM-5.3 获 AA 智能指数 60 分,追平 Kimi K3(10 条相关)→
「模型」频道最新
- Dots Studio 开源递归自我改进模型,主打自我批评机制 — omarsar0 · 2026-08-20
- dots3-note 展示环境交互、假设验证与记忆更新能力 — omarsar0 · 2026-08-20
- dots3-note Preview 展示未知环境适应与自迭代能力 — omarsar0 · 2026-08-20
- dots3-note 模型发布:280B 参数与自评估任务进展能力 — omarsar0 · 2026-08-20
- 彭博让七大AI代理比拼vibe coding,测中美谁领先 — pstAsiatech · 2026-08-20
- Frontier Radar:中国模型已追赶,西方 AI 优势还剩多少? — The Decoder · 2026-08-20