多智能体不如单智能体?谷歌等260次实验揭示协作隐形成本
pliang279 · x · 2026-08-14
Google Research、DeepMind 和 MIT 联合发表的一项研究,在控制工具、提示词和算力等变量的前提下,跨六个基准测试了 260 种智能体配置。
研究得出了一个反直觉的结论:当单智能体的任务成功率超过 45% 时,增加更多智能体反而会导致性能下降。
- 错误放大效应:单智能体为 1.0 倍,去中心化架构高达 7.8 倍,而完全独立的架构更是达到 17.2 倍。
- 效率对比:单智能体每千 token 的成功率为 67.7,远高于混合架构的 13.6。
- 实测表现:在 SWE-bench 基准上,所有多智能体变体的得分均低于单智能体。
这表明,多智能体系统中的协调成本往往会抵消甚至超过其带来的额外能力收益。
所属事件:谷歌与Nature研究揭示多智能体协作存在隐形成本(2 条相关)→
「编程与Agent」频道最新
- Plannator 发布技能:用 HTML 生成 Agent 交互原型 — tom_doerr · 2026-08-24
- DocketBird MCP 服务器:支持搜索下载法院文档 — modelcontextprotocol · 2026-08-24
- AgentLux MCP 服务器:支持市场和社交流程 — modelcontextprotocol · 2026-08-24
- MongoDB 发布 Agent 工具包,让编码助手精通数据库 — TheTuringPost · 2026-08-24
- 开发软件前先让 Agent 查开源库,99% 的情况是正解 — generativist · 2026-08-24
- 开发者瓶颈不在 AI 上下文,而在人脑认知负荷 — Vidhrohi · 2026-08-24