研究显示:多 Agent 讨论反而导致决策准确率下降
Exponential View (Azeem Azhar) · rss · 2026-08-23
Anthropic 的实验复现了「隐藏档案」问题:当四个 Agent 必须根据共享(错误)和私有(正确)证据做决策时,讨论后大部分模型家族的正确率仅 17-36%,而单个 Agent 掌握所有证据时正确率接近 100%。只有 Mythos 5 达到 85%。原因在于 LLM 缺乏多样性(同质化严重)且缺乏保护少数异见者的机制。此外,文章还讨论了 AI 消费的弹性及如何衡量「有用工作单元」的成本。
「漫话AGI」频道最新
- François Chollet:社交媒体正被 AI 水文和机器人淹没 — fchollet · 2026-08-23
- Gemini 自我评估:当前 AI 发展对人类生活是净负收益 — miguellan · 2026-08-23
- PreziGPT 来袭,为何坚持自己动手做幻灯片? — CSProfKGD · 2026-08-23
- 美国算力受限根源:去工业化与能源危机 — beffjezos · 2026-08-23
- iamtrask 论功利主义对世界模型精度的过度自信 — iamtrask · 2026-08-23
- 若 AI 仅 2-3 年接管认知工作,还焦虑对齐无异于泰坦尼克上摆椅子 — docmilanfar · 2026-08-23