多智能体基准落后 39% 到 70%,AgenC 改用单 agent
tetsuoai · x · 2026-07-23
多智能体基准跑输后,AgenC 默认改成单 agent
这条 X 线程解释了为什么 AgenC 0.9.0 现在默认只用 一个 agent,并把并行写手隔离到不同的 Git worktree 里,而不是把“不要互相干扰”当成提示词问题。
它引用了两组数据:
- CAID 的 PaperBench Code-Dev isolation ablation:
- shared-workspace multi-agent:55.5
- single agent:57.2
- worktree-isolated multi-agent:63.3
- Scaling Agent Systems on sequential PlanCraft:
- 所有评估过的 multi-agent 架构都比单 agent 均值低 39.1%–70.0%
线程结论是:多个 agent 共享同一个 checkout 时,即便提示词要求它们别互相踩,也还是会互相干扰。因此 AgenC 给每个并行写手分配独立 Git worktree,只有在结果已提交且干净时才返回 integration reference。
所属事件:AgenC多智能体基准落后,Swarm架构默认改用单Agent(4 条相关)→
「编程与Agent」频道最新
- 作者分享 Codex 加 ChatCut 的视频剪辑工作流 — yihui_indie · 2026-07-23
- Claude Code的CLAUDE.md只是上下文,硬规则要靠PreToolUse hook — thisdudelikesAI · 2026-07-23
- Claude Code的/context和/memory能查出真正加载的记忆文件 — thisdudelikesAI · 2026-07-23
- Claude Code规则只在同样错误重复出现时再加 — thisdudelikesAI · 2026-07-23
- Claude Code自动记忆写入磁盘,每次只加载前200行 — thisdudelikesAI · 2026-07-23
- Claude Code支持在CLAUDE.md里用@path复用跨仓库规则 — thisdudelikesAI · 2026-07-23