罗马一大研究:AI 智能体会按模型出身拉帮结派
alex_verem · x · 2026-10-08
罗马一大(Sapienza University)论文发现,多智能体 LLM 系统中,一旦智能体知道彼此的模型家族,就会自发按「出身」结成小团体,即使任务完全不奖励这种行为——作者称之为 factionalism(派系主义)。
- 实验设置:9 到 25 个来自最多 5 个开源模型家族的智能体,玩需要合作达成共识的群体游戏(选 leader 或淘汰成员)
- 关键发现:给智能体假模型名,它们按假名抱团;换成 teal/coral 等颜色标签,就按颜色站队;隐藏标签后,12 次实验中从未形成派系
- 一个 Qwen 智能体明明有正确答案,却因「Qwen 模型通常可靠」改投另一个 Qwen 智能体的错误答案,全组答错
- 代价:贴标签组平均多花 30% 轮次、55% token 才达成决定,成功率从 96% 降到 81%
作者的缓解建议很简单:不要向智能体暴露模型身份,编排器可保留这些信息用于路由和调试。
所属事件:罗马一大研究发现 AI 智能体会按模型出身自发结派(2 条相关)→
「编程与Agent」频道最新
- 开发者吐槽:AI Agent 热衷整理没人让它碰的文件 — JFPuget · 2026-10-08
- 开源桥接工具:把浏览器聊天页变成 OpenAI 兼容本地 API — harshanacz · 2026-10-08
- GraphRAG 增量更新漏洞:删除的文档仍留在索引中可被检索 — JeremyCMorgan · 2026-10-08
- 论文:Vibe Coding 正在杀死开源,被推荐组件 Star 反跌 — soumitrashukla9 · 2026-10-08
- Every 发布 Compound Engineering 权威指南:让代码库越写越容易 — every · 2026-10-08
- Claude Haiku 5.5 发布:与 GPT-6 Luna 同价,但暗藏 token 膨胀 — Simon Willison · 2026-10-08