Databricks称Genie Code以每任务0.55美元胜过三款编码Agent
matei_zaharia · x · 2026-07-26
Databricks 认为,更好的数据 agent 不但更准,还能更省。
他们在 401 个真实内部数据任务 上,把 Genie Code 与三款通用 coding agent 做了正面对比。所有 agent 都使用各自的 harness、前沿模型、Databricks MCP,并被限制在相同的 20 分钟任务预算内。
结果显示:
- 准确率:76.6%,为全场最高
- 平均成本:每任务 0.55 美元,为全场最低
- 成本优势:比其他 agent 低一半以上
Databricks 把优势归因于上下文能力:语义搜索、持久记忆和对工作区的理解,减少了无效的随机探索,让 agent 更快找到正确答案。
所属事件:Databricks称其Genie Code在真实数据任务上胜出且成本极低(2 条相关)→
「编程与Agent」频道最新
- 长周期智能体最终需要不可变事件日志 — sebpaquet · 2026-07-27
- 实测智能体数据科学工作流:代码能跑但常答错问题 — hugobowne · 2026-07-27
- 一个 VS Code 扩展给 Alchemy 模板加上 Markdown 高亮 — samgoodwin89 · 2026-07-27
- Claude 的 Stripe MCP 连接器被吐槽频繁断连几乎不可用 — evielync · 2026-07-27
- Reddit 用户称 Vecel Eve 像给 agents 用的 Next.js — richie9830 · 2026-07-27
- 卡兹克开源 Leader.skill:把模糊需求变成 Agent 目标书 — 数字生命卡兹克 · 2026-07-27