GLM 5.2编码表现进步明显
matei_zaharia · x · 2026-07-09
Databricks 说,GLM 5.2 在他们的内部代码任务上表现出明显进步,甚至在与 SWE-Bench、TerminalBench 很不一样的代码库中也成立。该代码库包含 Scala、Go、Rust、Java、TypeScript、Protobuf 和 Jsonnet 等多种语言。
这条结论说明,开源编码智能体在真实企业代码环境中的表现正在变强,而且不只是在标准公开基准上有效。
所属事件:Databricks发布企业内部代码基准,架构比模型更影响成本(16 条相关)→
「编程与Agent」频道最新
- MCP 链式调用无回滚:agent 工程的真实痛点 — agentrsdg · 2026-09-11
- DeepMind 等论文:设计文档当真相源,代码改为可抛弃产物 — Roger_M_Taylor · 2026-09-11
- 用 Agent 造小分类器:19 万文档标注成本仅 0.7 美元 — vanstriendaniel · 2026-09-11
- MathModelAgent 走红:自动完成数学建模并生成可提交论文 — jihe520 · 2026-09-11
- alphaXiv 开源 OpenResearch:用任意模型并行跑研究智能体 — alphaXiv · 2026-09-11
- 开源 AI 销售 OS DeskcommCRM 爆火:自带 Agent 与 WhatsApp 集成 — melgarafael · 2026-09-11