Databricks构建超大规模代码基准测试

matei_zaharia · x · 2026-07-09

Databricks 基于公司内部包含数百万行代码的代码库,构建了一个专属的 AI 编码基准测试。该测试旨在更真实地评估大模型在大型企业级代码库中的实际表现。

所属事件:Databricks发布企业内部代码基准,架构比模型更影响成本(16 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →