Google 260 组实验:多智能体可快 80.8%,也可差 70%

alex_verem · x · 2026-07-25

Google Research、DeepMind 和 MIT 做了目前规模最大的多智能体系统对照研究,在 6 个基准、5 种架构、260 种配置 上,用相同工具和算力预算测试了 OpenAI、Google、Anthropic 三家模型。

研究结论非常明确:

这篇论文的核心建议很直接:只有当任务真的能拆成彼此独立的部分时,才值得上多智能体。

所属事件:谷歌大规模实验揭示多智能体系统双刃剑效应(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →