实测称 max 推理档更贵反而跑输,多数编码任务用 high 就够

weswinder · x · 2026-10-10

开发者吐槽「max reasoning 档就是浪费钱」:据他实测,astra 模型在 max 档的成本远高于 xhigh 档,但在 Terminal Bench 4 上得分反而更低。对大多数编码任务,high 档能以低得多的价格拿到基本相同的结果。

他欢迎有人用实测打脸——这条对按 token 计费的重度编码用户是直接的省钱参考,但为个人实测、样本细节未给出。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →