Astra 以 30k tokens 跑出 74% DeepSWE 成绩,效率碾压 GPT-5.6 Sol
haider1 · x · 2026-09-05
博主 haider1 对比了 DeepSWE benchmark 上两个模型的表现:Astra 仅用 3 万输出 tokens、29 步、6.52 美元就拿到 74% 成绩;而 GPT-5.6 Sol 得分 73%,却需要 6 万 tokens、61 步。两者花费几乎相同(6.46 美元),但 Astra 的 token 与步数效率约是 Sol 的两倍。作者感叹 Astra 的效率惊人——尤其 Sol 仅发布几个月。
「模型」频道最新
- 重度用户力挺 Astra:直觉智能碾压同价的 Fable 5.1 — DynaBeast · 2026-09-05
- 问 Fable 5.1 生物安全论文被拒:网友吐槽遭遇「Opus 式拦截」 — nathanbenaich · 2026-09-05
- 同一道电脑检查题,Claude 与 GPT-6 Astra 给出相反答案 — Jardani_xx · 2026-09-05
- Grok 4.6 上线 xAI API,宣称上下文达50万token — emmanuelvivier · 2026-09-05
- Anthropic 发布企业安全套件,隐私与滥用检测合一 — emmanuelvivier · 2026-09-05
- 开源工具 heretic 一键去审查:Gemma 3 12B 百条有害测试拒绝从 97 降到 3 — thisguyknowsai · 2026-09-05