GLM-5.3 Terminal Bench 3.0分数翻6倍,博主将实测
karminski3 · x · 2026-08-14
博主karminski3对GLM-5.3在Terminal Bench 3.0上的测试分数翻6倍表示惊讶,并分析了其可能原因。他认为GLM-5.3在复杂真实环境下的架构规划能力将非常强,尤其是面对黑盒API和自写Prompt的套娃任务。博主表示稍后将带来实测。
「模型」频道最新
- 开发者吐槽:几乎没人再用 bf16 了 — GavinSBaker · 2026-08-14
- 你最喜欢的冷门模型是什么?网友力荐 Nambeige 3B — Ecstatic-Wash-7667 · 2026-08-14
- 智谱 GLM 5.3 隔夜发布,编码能力大幅提升 — bindureddy · 2026-08-14
- 阿里 Qwen 官方预告:不到 2 小时,即将见面 — Alibaba_Qwen · 2026-08-14
- 用户发现 Gemini 3.7 Flash 不再支持 minimal 思考档 — PleasantSir9581 · 2026-08-14
- 小红书开源dots3-note:IMO满分42/42,Apache 2.0 — eyishazyer · 2026-08-14