实测称Agent框架选择对大模型成本影响巨大

近期针对 AI 编程智能体的基准测试显示,在模型、任务和提示词完全相同的情况下,仅更换不同的 Agent 框架,单次任务成功的成本差距可达 5 到 30 倍。在涵盖 26 个任务的 TerminalBench 测试中,Kimi Code 以 21/26 的成功率夺冠,超越了 Claude Code 与 Codex。这表明开发者需高度重视模型与运行框架的适配优化。

2026-08-05 ~ 2026-08-05 · 3 条相关