按真实用户反馈排座次:Claude Code 居 17 款编码 Agent 之首
ptkbhv · x · 2026-10-07
Enterpret 发布 Feedback Bench,用 Reddit、X、G2、Trustpilot 上的公开用户反馈(2026-08-31 至 10-04 窗口)为 17 款编码 Agent 打分,覆盖 63 项指标,每个数字都附来源链接。
- 前五:Claude Code(73.1)、OpenAI Codex(66.0)、开源 OpenCode(64.7)、Cursor(59.2)、Google Antigravity 与 Devin、Pi 并列第五(约 54)。
- 客户喜爱度(customer love)最高的是 Devin 与 Pi(约 0.60);垫底的是 Grok Build(12.4)与 Augment Code(9.4)。
- 团队称这是「用真实工作检验而非实验室跑分」,个人 Agent 榜单是下一步。
「编程与Agent」频道最新
- Seaworthy 发布:让 AI Agent 打电话、付款、跑腿的单体 API — jefrankle · 2026-10-07
- 麦肯锡调查:32% 企业因 AI 编程工具放弃外购软件,科技业达 41% — import_jmr · 2026-10-07
- 开发者发起讨论:agent harness 工具冗余,是否需要统一的 meta-harness — yb2698 · 2026-10-07
- 换 harness 组件看模型表现:terminal-bench 任务在线实测 demo — yb2698 · 2026-10-07
- 开发者实测 5000+ ChatGPT 插件:模型只能真正看见几百个 — _nixa_ · 2026-10-07
- 27B+Pi 得分最高,token 消耗却是 Qwen Code 的近 1.5 倍 — yb2698 · 2026-10-07