编码Agent榜更新:Sonnet 5.5登顶68分,成本却是GPT-6.1的13倍

ArtificialAnlys · x · 2026-10-02

Artificial Analysis 更新 Coding Agent Index(组合 DeepSWE v1.1、Terminal-Bench 4.0、SWE-Atlas-QnA 三项基准),本周三家新模型齐登榜首但性价比差异悬殊:

结论:三者性能接近,但成本差出 13 倍量级,选型时性价比考量比榜单名次更重要。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →