多智能体系统新研究:128 个 Agent 把难题通过率提升 49%

OfirPress · x · 2026-09-29

Agensh 研究在 ProgramBench 5 个最难任务上,用 GPT-5.6-sol(高推理档)+ Copilot 作为单 agent 底座,把 agent 数量从 1 扩展到 128,6 小时最终通过率从 19.31% 升至 28.78%,相对提升约 49%。Ofir Press 转评认为多智能体系统研究空间很大,值得探索的关键问题包括:agent 是否需要层级组织、应否预先指定组织方式还是让它们自主形成、是否一开始就分配角色等。

所属事件:微软发布无中心编排多智能体框架 Agensh(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →