实测发现 Astra 高努力档空耗 token,terminal bench 上仅低中高档可用
zainhas · x · 2026-09-05
开发者 zainhas 分享对 Astra 模型的实测观察:在高努力(high effort)设置下模型大量消耗 token 却收效甚微,称之为「奇怪的模型」。
- 作者称只有 low、medium、high 三档努力设置实际可用
- 同样的模式在 Terminal Bench 4.0 和 deepswe 基准上均复现
- 结论指向 Astra 的努力档位与 token 消耗之间存在明显不成比例的问题
「模型」频道最新
- antirez 盛赞 Astra:RLVR 规模化的大模型让软件开发跃升 — antirez · 2026-09-05
- 重度用户力挺 Astra:直觉智能碾压同价的 Fable 5.1 — DynaBeast · 2026-09-05
- 问 Fable 5.1 生物安全论文被拒:网友吐槽遭遇「Opus 式拦截」 — nathanbenaich · 2026-09-05
- 同一道电脑检查题,Claude 与 GPT-6 Astra 给出相反答案 — Jardani_xx · 2026-09-05
- Grok 4.6 上线 xAI API,宣称上下文达50万token — emmanuelvivier · 2026-09-05
- Anthropic 发布企业安全套件,隐私与滥用检测合一 — emmanuelvivier · 2026-09-05