研究发现多 Agent 协调存在相变,GPT-4o 约 80 人达共识
bravo_abad · x · 2026-08-18
Giordano De Marzo 等人的研究表明,LLM 智能体群体的协调能力可以用统计物理学的数学模型描述。实验将智能体置于最小二元决策环境中,发现其行为映射到铁磁体的 Curie-Weiss 模型:智能体类似自旋,集体意见类似磁化强度。研究定义了参数“多数力”(β)来衡量智能体对集体状态的响应。结果显示,随着群体规模增大,达成共识变得指数级困难。不同模型的临界规模不同:Llama 3 70B 约为 30 个智能体,GPT-4o 约为 80 个,GPT-4 Turbo 约 1000 个,而 Claude 3.5 Sonnet 在测试的 1000 个智能体规模下仍保持协调。这提示我们,评估智能体系统需考虑群体动力学,而非仅看个体表现。
「编程与Agent」频道最新
- 开源 Qwen+RF-DETR 本地目标检测工作流 — MaziyarPanahi · 2026-08-18
- Hugging Face 用 AI 智能体复现 2200 篇 ICML 论文 — huggingface · 2026-08-18
- Compound Engineering:让每次工程产出复利的 agent 技能包 — iamrobotbear · 2026-08-18
- Cloudflare Durable Objects 上线版本流量监控面板 — ritakozlov · 2026-08-18
- Claude 动态工作流与 Codex 语音模式实战体验 — alliekmiller · 2026-08-18
- AutoDesign 框架:优化 Agent 马甲,海报生成超 Claude — KyeGomezB · 2026-08-18