GLM-5.3 Terminal Bench 3.0分数翻6倍,博主将实测

karminski3 · x · 2026-08-14

博主karminski3对GLM-5.3在Terminal Bench 3.0上的测试分数翻6倍表示惊讶,并分析了其可能原因。他认为GLM-5.3在复杂真实环境下的架构规划能力将非常强,尤其是面对黑盒API和自写Prompt的套娃任务。博主表示稍后将带来实测。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →