斯坦福多智能体协作研究:团队成绩 66.7% 远超单模型
mark_k · x · 2026-09-27
Stanford 与 Together AI 的新论文显示,AI 智能体团队正在学会协同工作,而非按固定脚本执行。
- 智能体团队自主学习何时分工、互相质疑、合并各自的局部解
- 在五个数学与物理基准上,团队平均准确率达 66.7%,而最强单成员仅为 48.8%;即便给该成员同等算力预算,也只达 58.7%
- 最有意思的发现:团队甚至胜过一个「只要任一成员独立找到正确答案就能选中它」的系统——说明讨论产生了没有任何成员单独得出的答案
作者强调这些结果尚待独立复现。
「编程与Agent」频道最新
- IBM 开源 Docling:免费 Python 库把任意文档转成结构化数据 — mdancho84 · 2026-09-27
- 程序员自述:LLM 时代写代码成了浪费时间的事 — justalexoki · 2026-09-27
- 奖励黑客比想象普遍:git 未剪枝可偷看补丁、判分器同沙箱可改测试 — willcb · 2026-09-27
- 用 Claude Opus 5.5 全代码打造「内容弹珠机」讽刺流量分配 — CurieuxExplorer · 2026-09-27
- 开发者缓存成安全盲区:扫出 264 个带 CVE 的包,71.7 GiB 无人审计 — julsimon · 2026-09-27
- WebMCP 兴起:智能体网络的 HTML/API 层? — Thionne_WTZ · 2026-09-27