苹果论文:单 Agent 加 Shell 胜过复杂多 Agent 编排

苹果发表论文《一个强 Agent 的自主 ML 工程需要多少 Harness》,得出反直觉结论:在相同时间预算、相同前沿 LLM 底座条件下,开源 SOTA 的复杂 agent harness 相比只有极简 harness 的单会话编码 Agent 并无优势。数据显示单 Agent 加 Shell 的 Kaggle 奖牌率达 62.5%,高于复杂编排的 47.1%,引发对 Agent 框架复杂度必要性的反思。

2026-10-07 ~ 2026-10-09 · 3 条相关

另有 1 条近重复转述:himanshustwts