斯坦福论文:自组织 Agent 团队 66.7% 胜过最强单模型 48.8%

dair_ai · x · 2026-09-23

斯坦福与 Together AI 的论文展示让 Agent 团队自行学习协作策略的价值:

核心机制:由一个成员回顾团队此前的交流,重写协作策略,涵盖角色分工、讨论阶段顺序、谁参与、部分答案如何合并。策略仅从 15 道 AIME 2024 题中学得,即可不加修改地迁移到保留题和四个新基准上。

所属事件:斯坦福论文:自组织Agent团队学会协作推理(5 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →