研究实测:隐藏模型名可让智能体成功率从 96% 降至回升

alex_verem · x · 2026-10-08

同一研究的详细版:罗马一大团队让 9-25 个智能体在群体游戏中选 leader 或淘汰成员。可见模型名时,智能体按模型家族站队;给假名或换成颜色标签,它们照旧按假信息抱团,真实模型能力反而影响不大。

具体案例:科学问答中一个 Qwen 智能体本有正确答案,却因「Qwen 模型通常可靠」改投同门错误答案,全组答错。平均而言,贴标签组多花 30% 轮次和 55% token,成功率从 96% 跌到 81%。建议:编排器保留模型信息用于路由调试,但不要暴露给智能体本身。运行多模型系统时应检查智能体能看到彼此的什么信息。

所属事件:罗马一大研究发现 AI 智能体会按模型出身自发结派(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →