「Harness 税」实锤:同样 15 轮,Claude Code 成本是 Pi 的两倍

HamelHusain · x · 2026-09-17

Melissa Pan 对智能体框架的成本差异做了量化分析,转发自 Hamel Husain:在 SWE-bench Lite 上,Pi 与 Claude Code 运行 Fable 5 的平均轮次几乎相同(15.4 vs 15.3),但 Claude Code 成本约是 Pi 的两倍,换来的成功率提升仅 1.1 个百分点。

关键发现:

对正在选型或自建 agent 框架的团队有直接参考价值:框架的开销可能比模型本身更烧钱。

所属事件:实测「Harness 税」:编码框架不影响成功率却让成本翻倍(7 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →