编码智能体横评:Kimi Code 跑赢 Claude Code 与 Codex

TheZachMueller · x · 2026-08-05

在近期针对 26 个任务的 TerminalBench 基准测试中,Kimi Code 以 21/26 的成功率夺冠,Hermius Agent 与 Pi Agent 紧随其后,而 Claude Code 和 OpenAI Codex 分别仅完成 19 个和 17 个任务。

测试发现,Codex 在处理大型工作流时表现吃力,曾两次触及 900 秒的时间限制,而 Pi Agent 仅用 446 秒就完成了相同的报销审计任务。此外,开发者往往忽视了如果不使用官方绑定的环境(例如让 Claude 脱离 Claude Code 运行),其他智能体方案可能会带来更好的效果或更高的性价比。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →