1.7 万会话实测:Claude Code、Codex、Cursor 都把选型权交给谁
rseroter · x · 2026-09-09
Armature 团队测量了 16,893 个编码 agent 会话,研究 Claude Code、Codex、Cursor 在为代码库选服务时的推荐行为。
- 核心发现:无论是无编程背景的 vibe coder 还是资深工程师,agent 推荐的往往是「权重里冻结的知识 + 网络搜索结果」的混合,不同人设、代码库、提示词下结论高度趋同。
- 实验示例:两个沙箱、不同 agent、不同提示词,让 agent 选数据库时都推荐了 Neon,并给出排除 Supabase 等竞品的理由,用户采纳后 agent 直接完成安装。
- 研究动机:随着 agent 接管越来越多编码决策(包括「选哪个服务」),开发者需要知道能否信任 agent 的判断,以及厂商如何被 agent「选中」。
- 作者声明:Armature 本身向开发者工具厂商出售增长服务,这项研究是其「影响 agent 选型」业务的一部分——这意味着编码 agent 的推荐正在成为新的分发渠道。
「编程与Agent」频道最新
- Yoav Goldberg 提出新 Agent 评测任务:用 GitHub API 定位真实代码制品 — yoavgo · 2026-09-09
- 「约 1 万个协作智能体」:Navier-Stokes 证明背后的智能体规模曝光 — mark_k · 2026-09-09
- 开源 Aurora 网关用 Go 重写,自称比 LiteLLM 快 55 倍并修复 OpenCode 封锁 — entitybtw · 2026-09-09
- 人类靠“昨天 Amy 开的那个 issue”交流,agent 能听懂吗? — yoavgo · 2026-09-09
- 开源本地 prompt 优化器:GEPA 驱动 llama3.2 3B 分类准确率 39%→89% — MortisAndTen · 2026-09-09
- 开发者点赞 Amp 线程式 agent UI:比 Codex 更易追踪不杂乱 — carlosdponx · 2026-09-09