研究实测:隐藏模型名可让智能体成功率从 96% 降至回升
alex_verem · x · 2026-10-08
同一研究的详细版:罗马一大团队让 9-25 个智能体在群体游戏中选 leader 或淘汰成员。可见模型名时,智能体按模型家族站队;给假名或换成颜色标签,它们照旧按假信息抱团,真实模型能力反而影响不大。
具体案例:科学问答中一个 Qwen 智能体本有正确答案,却因「Qwen 模型通常可靠」改投同门错误答案,全组答错。平均而言,贴标签组多花 30% 轮次和 55% token,成功率从 96% 跌到 81%。建议:编排器保留模型信息用于路由调试,但不要暴露给智能体本身。运行多模型系统时应检查智能体能看到彼此的什么信息。
所属事件:罗马一大研究发现 AI 智能体会按模型出身自发结派(2 条相关)→
「研究」频道最新
- LeJEPA 让你能在自有数据上预训练自监督视觉模型,不再等下一个 DINO — randall_balestr · 2026-10-08
- LEDGER:从第一视角视频构建持久 3D 物体记忆,不看回放答题 — mangahomanga · 2026-10-08
- Applied Compute 发布 On-Policy 自蒸馏,逼近持续学习 — ypatil125 · 2026-10-08
- Depth2Depth:用 DepthAnything 修补 RealSense 深度图的开源方案 — chrismatthieu · 2026-10-08
- NavSafe-∞ 基准:280 个闭环场景测出 20 个端到端驾驶策略的安全缺口 — zhoubolei · 2026-10-08
- 实测:pplx-decider 可开箱即用地替代 Fineweb-edu 分类器筛数据 — bo_wangbo · 2026-10-08