争论续:Astra 用约 1/5 推理 token 逼近 Opus 5.5 得分

VraserX · x · 2026-10-06

VraserX 继续模型之争:Opus 5.5 Max 得分 58 vs Astra 的 53,但消耗约 5 倍推理 token;同等预算下差距基本抹平。Astra 仍在 FrontierMath、EyeBench、AutomationBench 和 Terminal-Bench Science 上领先。「更多算力换来略高分不是更聪明的证明,只是花了更多算力」;Claude Code 使用量高只说明用户喜欢该产品,不代表模型更聪明。

所属事件:GPT-6 Astra 与 Claude Opus 5.5 的智能与 token 效率之争(9 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →