智谱 GLM-5.3 获 DeepSWE 评测 69 分
AccBalanced · x · 2026-08-20
据博主转发,智谱 GLM-5.3 模型在官方 DeepSWE 排行榜上获得了 69 分的成绩。
所属事件:智谱 GLM-5.3 后训练强化,DeepSWE 评分从 44 跃升至 69(2 条相关)→
「模型」频道最新
- Cribl 发布 SecIT Bench:14 模型诊断成本差距达 20 倍 — jonathan_wilke · 2026-08-20
- Claude 严重的幻觉问题:编造发货时间与门槛 — Secret_Divide_3030 · 2026-08-20
- 开发者盛赞 Qwen 3.8 27B 模型:刷分更实用 — rudrank · 2026-08-20
- Anthropic 研发 Claude 文本水印:复制粘贴改写后仍可被检测 — Matt Wolfe · 2026-08-20
- DeepSeek 涨价后用户留存情况投票引发关注 — oran_ge · 2026-08-20
- Cohere 揭示 LLM 语言推理瓶颈:14B 模型反超大模型 — Cohere_Labs · 2026-08-20