苹果论文:单 Agent 加 Shell 胜过复杂多 Agent 编排
苹果发表论文《一个强 Agent 的自主 ML 工程需要多少 Harness》,得出反直觉结论:在相同时间预算、相同前沿 LLM 底座条件下,开源 SOTA 的复杂 agent harness 相比只有极简 harness 的单会话编码 Agent 并无优势。数据显示单 Agent 加 Shell 的 Kaggle 奖牌率达 62.5%,高于复杂编排的 47.1%,引发对 Agent 框架复杂度必要性的反思。
2026-10-07 ~ 2026-10-09 · 3 条相关
- 苹果论文:单 Agent 加 Shell 胜过多 Agent 编排,Kaggle 奖牌率 62.5% 对 47.1% — rohanpaul_ai · 2026-10-07
- 苹果论文:同等时间预算下复杂 harness 不比单会话编码 Agent 更强 — himanshustwts · 2026-10-09
另有 1 条近重复转述:himanshustwts