斯坦福论文:自组织 Agent 团队 3 模型协作 66.7%,碾压最强单模型

rohanpaul_ai · x · 2026-09-25

Stanford 与 Together AI 的论文提出自组织 Agent 团队(SAT),反驳流行的「辩论+投票」多智能体套路——投票大多只是在既有答案里挑一个,创造不出新解。

核心做法:

结果:五个数学与物理 benchmark 上,3 模型团队平均准确率 66.7%,远超最强单模型的 48.8%、等算力推理的 58.7%,甚至超过对成员独立答案做完美路由的 59.0%;AIME 2026 上超完美路由 13.4 分——团队真的算出了任何成员都没有的正确答案。

所属事件:斯坦福论文:自组织Agent团队胜过最强单模型(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →