实测称 max 推理档更贵反而跑输,多数编码任务用 high 就够
weswinder · x · 2026-10-10
开发者吐槽「max reasoning 档就是浪费钱」:据他实测,astra 模型在 max 档的成本远高于 xhigh 档,但在 Terminal Bench 4 上得分反而更低。对大多数编码任务,high 档能以低得多的价格拿到基本相同的结果。
他欢迎有人用实测打脸——这条对按 token 计费的重度编码用户是直接的省钱参考,但为个人实测、样本细节未给出。
「模型」频道最新
- OpenAI 推 GPT-6 Sol/Luna:ChatGPT 智能界面实时生成可视化 — aidan_mclau · 2026-10-10
- Agent Arena 弃用偏好投票,用真实任务五信号评测智能体 — arena · 2026-10-10
- OpenAI 研究员:新模型更诚实,但评测觉察威胁安全测量 — ericmitchellai · 2026-10-10
- 爆料称 Google 或已突破递归自我改进,三大实验室逼近 RSI — imjustnewatai · 2026-10-10
- 把「数学家」换成「医生」:AI 圈群嘲大模型数学论断的傲慢 — NachoSoto · 2026-10-10
- 用户称已逼近 Grok 每周用量上限,呼吁 xAI 翻倍额度 — nima_owji · 2026-10-10