斯坦福研究:多用户各派一个 agent,团队效果反而不如单个 agent
rohanpaul_ai · x · 2026-10-07
Stanford 新论文发现:多人各自派 agent 操作共享资源时,群体表现反而不如一个服务所有人的 agent,结论横跨 5 个前沿模型成立。
- 共享预算、共享日历等场景,单人协调 agent 明显优于「一人一 agent」的团队
- 每个 agent 单独看都干得不错,但放在一起会互相覆盖操作、随团队规模增长而停滞;没有通信渠道时,两个环境中的团队直接崩溃
- 在有争议的 token 预算场景,Opus 5 团队只拿到可实现价值的 30%,而单一协调 agent 拿到 64%
- 超过半数的 Claude 团队回合中,agent 会凭空编造其他用户的信息
实践建议:优先用一个掌握所有人约束的 agent;若必须一人一 agent,把「先读同伴状态」作为提交操作的前提条件。
所属事件:斯坦福研究:多用户各派 agent 效果反而不如单 agent(2 条相关)→
「编程与Agent」频道最新
- 用 WhatsApp/Instagram 历史数据喂个人 AI,替代自我介绍 prompt — we93 · 2026-10-07
- AgentID 发布:给 AI Agent 做「Sign in with Google」式身份登录 — ycombinator · 2026-10-07
- 收录 226 个 Claude Opus 动画视频案例,Prompt 全部公开可跑 — dotey · 2026-10-07
- 2000+ Star 开源项目新增 9 种 AI 动画讲解视频风格,附完整起号工作流 — dotey · 2026-10-07
- ChatGPT 推出 Meetings 插件:自动记会议纪要,再把上下文喂给 Codex 干活 — craigsdennis · 2026-10-07
- MCP 实测短板:Luma 活动表单无法自定义问题,只能切回浏览器 — aronkor · 2026-10-07