Databricks称Genie Code在401个真实任务上胜出且每题仅0.55美元
DbrxMosaicAI · x · 2026-07-25
- Databricks 表示,给数据 agent 增加上下文,能同时提升准确率并降低成本。
- 他们从真实内部使用场景中抽取了 401 个任务,把 Genie Code 和三款主流通用 coding agent 做了对比。
- 每个 agent 都使用各自的 harness、最新 frontier 模型、Databricks MCP,并统一给了 20 分钟 的任务预算。
- 结果里,Genie Code 既是准确率最高的:76.6%,也是成本最低的:平均每题 $0.55。
- Databricks 认为优势来自上下文能力:语义搜索、持久记忆、workspace 理解 让它减少了无效探索,也就更少出错、超时和花钱。
「编程与Agent」频道最新
- Grok Build 更新加入引导教程、搜索覆盖和失败续跑 — elonmusk · 2026-07-25
- Anthropic 发布 Claude Code v2.1.220,主打修复与稳定性提升 — ashwin-ant · 2026-07-25
- Mac 编码 Agent 基准显示,harness 可让 token 下降 5 倍 — asankhs · 2026-07-25
- Andrew Ng发布免费一小时课程,讲Agentic知识图谱 — goyalshaliniuk · 2026-07-25
- Claude Code 新增去 AI 味写作 skill,能改稿也能检测 — aigclink · 2026-07-25
- 字节与莫纳什论文把任务经验蒸馏进软件代理权重 — imjustnewatai · 2026-07-25