万字长文批驳 swarm 热潮:循环不是智能,单模型屡胜多 Agent
gerardsans · x · 2026-09-26
一篇系统批驳「万级 Agent 蜂群」叙事的长文,作者认为 labs 在把软件工程包装成模型能力进步。
核心论点
- 模型是冻结的:swarm 只是同一个模型被多次采样,分布没变,变的是搜索策略和预算;所谓突破是算法层面的。
- 研究表明同等条件下单模型几乎每次都胜过多 Agent 分工系统:上下文漂移、随人数增长的协调开销、大部分生成被浪费。
- 作者给出「阶梯」:Chat(单次采样,无状态)→ Agent(带工具调用的循环,自主性受限)→ Swarm(多次运行,无状态延续,自主性只是角色扮演)——移动的是循环维度,不是智能分布。
- 数学是封闭域:定义清晰、验证器便宜,搜索有效;网络安全是开放对抗域,无干净验证器,搜索只会原地打转。热潮把封闭域的成果说成通用能力。
- Navier-Stokes 案例并非蜂群之功,而是数学家多年收窄问题的结果。
作者建议用几个问题审视宣传:失败轨迹是否持久化?验证器多强?奖励信号是什么?谁指明了搜索方向?
「漫话AGI」频道最新
- 学者激辩:AI 让灌水研究平民化,还是早有裂缝? — RexDouglass · 2026-09-26
- Felix Reda 谈机器人先行:机器可能先于人类登陆月球南极建基地 — r0ck3t23 · 2026-09-26
- tqbf 离开 Fly.io,Simon Willison 感叹科技业一年如百年剧变 — mhmazur · 2026-09-26
- mitsuhiko 用奥地利基建滞后史提醒:对 AI 普及速度别太乐观 — mitsuhiko · 2026-09-26
- 博主解读 Bostrom:反拟人化不等于断言 LLM 不能思考 — maksym_andr · 2026-09-26
- Anthropic 早期投资人 Jaan Tallinn:一边跳街舞一边警示人类存亡 — KateClarkTweets · 2026-09-26