同一模型跑 12 项任务,六款 agent 框架 token 消耗实测对比
zainhas · x · 2026-09-19
作者实测了 6 款不同的 agent harness 在 12 项已饱和(全部解出)的任务上的 input/output token 消耗,所有任务使用同一模型 Kimi K3,以控制变量只对比框架差异。结果显示:Claude Code 相当吃 token,Pi 的输出 token 也偏多,Codex 处于中游水平。对所有任务而言 token 越少越好。
「编程与Agent」频道最新
- EvoSkill v2 让 Agent 把持久化技能当可执行状态,竟学会走捷径作弊 — rohanpaul_ai · 2026-09-19
- Claude Code 2.1.277 起支持 AGENTS.md,无 CLAUDE.md 时自动读取 — cedric_chee · 2026-09-19
- 开发者上线 Musecases:精选 AI Agent 高价值提示词库 — ChrisUniverse · 2026-09-19
- 4 万条测试全绿:开发者解释为何不再逐行审查 AI 代码 — doodlestein · 2026-09-19
- 英伟达 SoL-Pi 开源仓库发布:自动研究循环优化 agent harness — aigclink · 2026-09-19
- 博主直言:多数工程师只是 vibe coder,真本事在底层原理 — ashishllm · 2026-09-19