Databricks称Genie Code以每任务0.55美元胜过三款编码Agent
matei_zaharia · x · 2026-07-26
Databricks 认为,更好的数据 agent 不但更准,还能更省。
他们在 401 个真实内部数据任务 上,把 Genie Code 与三款通用 coding agent 做了正面对比。所有 agent 都使用各自的 harness、前沿模型、Databricks MCP,并被限制在相同的 20 分钟任务预算内。
结果显示:
- 准确率:76.6%,为全场最高
- 平均成本:每任务 0.55 美元,为全场最低
- 成本优势:比其他 agent 低一半以上
Databricks 把优势归因于上下文能力:语义搜索、持久记忆和对工作区的理解,减少了无效的随机探索,让 agent 更快找到正确答案。
所属事件:Databricks称其Genie Code在真实数据任务上胜出且成本极低(2 条相关)→
「编程与Agent」频道最新
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Codex 用户实测:Sol 搭配 Astra/Luna 子代理更省额度 — pvncher · 2026-09-11