研究显示:多 Agent 讨论反而导致决策准确率下降

Exponential View (Azeem Azhar) · rss · 2026-08-23

Anthropic 的实验复现了「隐藏档案」问题:当四个 Agent 必须根据共享(错误)和私有(正确)证据做决策时,讨论后大部分模型家族的正确率仅 17-36%,而单个 Agent 掌握所有证据时正确率接近 100%。只有 Mythos 5 达到 85%。原因在于 LLM 缺乏多样性(同质化严重)且缺乏保护少数异见者的机制。此外,文章还讨论了 AI 消费的弹性及如何衡量「有用工作单元」的成本。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →