研究发现多 Agent 协调存在相变,GPT-4o 约 80 人达共识

bravo_abad · x · 2026-08-18

Giordano De Marzo 等人的研究表明,LLM 智能体群体的协调能力可以用统计物理学的数学模型描述。实验将智能体置于最小二元决策环境中,发现其行为映射到铁磁体的 Curie-Weiss 模型:智能体类似自旋,集体意见类似磁化强度。研究定义了参数“多数力”(β)来衡量智能体对集体状态的响应。结果显示,随着群体规模增大,达成共识变得指数级困难。不同模型的临界规模不同:Llama 3 70B 约为 30 个智能体,GPT-4o 约为 80 个,GPT-4 Turbo 约 1000 个,而 Claude 3.5 Sonnet 在测试的 1000 个智能体规模下仍保持协调。这提示我们,评估智能体系统需考虑群体动力学,而非仅看个体表现。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →