DeepSWE 实测:GLM-5.3 成本仅为 Fable 5 的 1/4
zainhas · x · 2026-08-23
在 DeepSWE 评测中,GLM-5.3 在单次尝试中得分 69.0%,与 Fable 5 (69.7%) 持平。但在成本上,GLM-5.3 每任务仅需 $3.99,远低于 Fable 的 $21,且 token 消耗和轮数表现各异。
所属事件:GLM-5.3 编码跑分追平 Fable 5,成本仅约五分之一(2 条相关)→
「编程与Agent」频道最新
- Codemap 工具:解析导入关系,为编码 Agent 生成精准结构图 — tom_doerr · 2026-08-23
- Browser Use 演示:Qwen 27B 跑分超人类,网速成唯一瓶颈 — TheMoonMidas · 2026-08-23
- pactx:开源闭环引擎,解决 AI 编码上下文漂移 — Glass-Oven-3745 · 2026-08-23
- OpenAI 称事故由前沿模型安全评估引发 — MelMitchell1 · 2026-08-23
- Gemini CLI 修复技能目录重复扫描 Bug — aniruddhaadak80 · 2026-08-23
- Claude Code 自动发现并修复生产环境 Bug 全流程实录 — mhmazur · 2026-08-23