同一模型跑 12 项任务,六款 agent 框架 token 消耗实测对比

zainhas · x · 2026-09-19

作者实测了 6 款不同的 agent harness 在 12 项已饱和(全部解出)的任务上的 input/output token 消耗,所有任务使用同一模型 Kimi K3,以控制变量只对比框架差异。结果显示:Claude Code 相当吃 token,Pi 的输出 token 也偏多,Codex 处于中游水平。对所有任务而言 token 越少越好。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →