Next.js Agent 榜:GPT-6 Sol 与 Opus 5.5 并列 97%,单价成本差 3 倍

pvncher · x · 2026-09-23

Vercel 发布 Next.js Agent Evals 最新榜单(2026-09-22),衡量 AI 编码 agent 完成真实 Next.js 任务的成功率。

榜首并列:GPT-6 Sol(Codex)与 Claude Opus 5.5(Claude Code)均达 97%,与 Claude Fable 5.1 持平;三者中 Opus 5.5 平均成本最低($0.234/任务),Fable 5.1 最贵($0.722)。

其他要点:

发帖人评论认为单任务均价已低于 $0.25,逐项式 eval 已饱和,现在 agent 动辄运行数小时。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →