数据对比引争议 Sonnet 5.5 被评失败发布

Reddit 用户与博主 haider1 依据 Artificial Analysis 数据对比同价($2/$10 每百万 token)的 GPT-6 Sol 与 Claude Sonnet 5.5,发现 GPT-6 Sol 每美元得分更高,单任务成本差异明显;Sonnet 5.5 在 medium 推理档得分与定价上不占优,且输出更啰嗦,被批评为一次糟糕的发布,不过也有观点认为其上限更强。

2026-09-29 ~ 2026-09-30 · 2 条相关

事件全程(共 9 集)→