GLM-5.3 登 TerminalBench 榜单,成本仅 GPT 5.6 Sol 一半
zainhas · x · 2026-08-25
GLM-5.3 在 TerminalBench-3.0 基准测试中表现出较强的性价比。数据显示,其成功率达到 32%,单次任务成本为 24 美元;相比之下,GPT 5.6 Sol 成功率为 35% 但成本高达 54 美元,GPT 5.6 Luna 成功率仅 14%。
「模型」频道最新
- 模型实测:Fable 5 复杂任务性价比最高,轮次显著少于竞品 — bindureddy · 2026-08-25
- GPT-5.6 Sol 因过度工程化被吐槽:代码冗长难维护 — Lenox_Shawn · 2026-08-25
- Qwen2.5 72B 本地实测:4090 跑出 100 tok/s — julianharris · 2026-08-25
- Grok Voice 夺冠,力压所有 GPT 实时模型 — XFreeze · 2026-08-25
- 网友实测:Minimax H3 用中文提问效果大幅提升,英文提示词或拖后腿 — apoke890 · 2026-08-25
- 疑似 Gemini 3.8 Flash 提前泄露,网友称谷歌兑现小模型更新承诺 — Last_Conclusion_8984 · 2026-08-25