Vercel 发布 Next.js AI 编码智能体评测,Kimi K3 与 Claude 并列榜首
evilrabbit_ · x · 2026-08-01
Vercel 官方发布了针对 Next.js 的 AI 编码智能体评测榜单,通过成功率、平均耗时和成本来评估各大模型在代码生成与迁移任务中的表现。
- 第一梯队:Kimi K3、Claude Fable 5 (high) 和 Cursor Composer 2.5 均取得了 92% 的基础成功率。其中 Kimi K3 成本极低($0.141),而 Cursor Composer 2.5 耗时最短且最便宜($0.046)。
- AGENTS.md 的奇效:榜单特别强调了提供 Next.js 官方文档上下文的 AGENTS.md 文件的作用。引入该文件后,绝大多数模型(如 GLM 5.2、Grok 4.5 等)的成功率均飙升至 96%。
- 成本与性能悬殊:GPT 5.5 Pro 耗时长达 771 秒且花费高达 $18.21,但成功率仅为 83%;相比之下,开源及国产模型在性价比上展现出显著优势。
「编程与Agent」频道最新
- antirez 实测多款国产 AI 模型编程能力 — antirez · 2026-08-01
- 用编程智能体狂刷开源项目Bug,七月连破六大底层代码库 — jxmnop · 2026-08-01
- AI 流水线翻车:121 个自动化测试全过,却产出垃圾内容 — Positive-Emu-8379 · 2026-08-01
- GenAI 工程师必知:驱动 AI Agent 的 8 种大模型 — mdancho84 · 2026-08-01
- 用 AI 自动反编译童年游戏,在公园带娃时见证奇点 — yacineMTB · 2026-08-01
- 多智能体编程体验:像通关极难游戏 — _arohan_ · 2026-08-01