SWE-Bench ProMax 发布:专测大规模多语言代码重构

_akhaliq · x · 2026-08-11

研究人员发布了名为 SWE-Bench ProMax 的全新基准测试,专门用于评估 AI 编程智能体在处理大规模、多语言代码重构任务时的能力。该基准旨在提供比以往更复杂、更贴近真实企业级开发场景的评测标准。

所属事件:字节推出多语言代码重构新基准 SWE-Bench ProMax(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →