Stanford 研究:多智能体协作成功率远低于单兵作战
_Hao_Zhu · x · 2026-08-14
斯坦福大学与 SAP 联合发布了 CooperBench,专门用于评估 AI 智能体团队的协作能力。研究发现,当前的 AI 智能体在团队协作中表现糟糕,甚至不如单打独斗。
- 协作反而拉胯:在相同工作量下,双智能体协作的成功率仅为 25% 左右,比单智能体处理双倍任务的成功率低了近 50%。
- 沟通无效且昂贵:智能体将高达 20% 的预算耗费在沟通上,虽然减少了代码合并冲突,但充斥着重复、无响应和幻觉,并未提升整体成功率。
- 三大协作鸿沟:期望失败(42%,未能整合伙伴状态信息)、沟通失败(26%,关键问题无人解答)、承诺失败(32%,违背诺言或做出无法验证的声明)。
「编程与Agent」频道最新
- Databricks 推出 Unity AI 网关智能路由,声称可降 30%+ 任务成本 — matei_zaharia · 2026-08-14
- DAB 基准测试:真实还原混乱数仓,揭示前沿模型的数据分析短板 — HamelHusain · 2026-08-14
- 开发者实测:DSH 框架在复杂项目上展现极高效率 — ChrisGPT · 2026-08-14
- Entire取消等待名单:为AI编码代理打造的Git托管平台正式开放 — craigsdennis · 2026-08-14
- Prime Agent开源:能自我重写提示词与记忆的递归智能体 — JeremyCMorgan · 2026-08-14
- Toast 1 搜索智能体实测:质量与速度兼得,价格仅十分之一 — xeophon · 2026-08-14