Terminal-Bench 4.0 发榜:GLM-5.3 超越 GPT-5.6

eyishazyer · x · 2026-08-29

新的 Terminal-Bench 4.0 榜单结果令人惊讶,由于测试难度提升,模型得分普遍下降,不再像旧版那样集中在高分段。

这一变化反映了基准测试在更具挑战性时,更能真实区分模型能力。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →