数据对比显示 Sonnet 5.5 更贵更啰嗦,被称一次失败发布

haider1 · x · 2026-09-30

博主 haider1 汇总 Artificial Analysis Intelligence Index 数据称 Sonnet 5.5 是一次糟糕的发布:medium 推理档下得 41 分但消耗 19k 输出 token,而 GPT-6.1 sol 得 48 分仅用 8k token;high 档下 Sonnet 5.5 得 47 分耗 34k token,6.1 sol 得 50 分耗 13k token。换算成本,6.1 sol max 每任务 $0.72,Sonnet 5.5 high $1.08,便宜 33% 且分数更高——结论是去掉 max 推理后 Sonnet 5.5 的竞争力明显不足。

所属事件:数据对比引争议 Sonnet 5.5 被评失败发布(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →