Astra 以 30k tokens 跑出 74% DeepSWE 成绩,效率碾压 GPT-5.6 Sol

haider1 · x · 2026-09-05

博主 haider1 对比了 DeepSWE benchmark 上两个模型的表现:Astra 仅用 3 万输出 tokens、29 步、6.52 美元就拿到 74% 成绩;而 GPT-5.6 Sol 得分 73%,却需要 6 万 tokens、61 步。两者花费几乎相同(6.46 美元),但 Astra 的 token 与步数效率约是 Sol 的两倍。作者感叹 Astra 的效率惊人——尤其 Sol 仅发布几个月。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →