GPT-6 Astra API 默认 low 推理档,「最高推理」宣传暗藏价格陷阱
docdavkitty · reddit · 2026-09-08
OpenAI 新旗舰 GPT-6 Astra(1.05M 上下文,$10/$50 每百万 token)发布,但作者指出几个实现细节比跑分更值得关注:
- 默认推理档为 low:reasoning.effort 现有 low/medium/high/xhigh/max 五档,API 默认 low,而模型卡主打「Highest reasoning」——不显式调档的集成实际买的是最便宜思考模式,同一模型 id 的应用表现可能天差地别。
- 定价陷阱:缓存输入 $1(0.1×),但缓存写入 $12.50(比未缓存输入还贵 1.25×);超过 272K token 触发断崖:整个请求输入/缓存按 2×、输出按 1.5× 计费。
- 跑分按任务读:DeepSWE 74.1 仅略超 GPT-5.6 Sol 的 72.7,增益集中在计算机使用与 agent(BrowseComp 91.5、OSWorld 2.0 72.6);OpenAI 主推 Terminal-Bench-Science 64.6 vs Claude Fable 5.1 的 52.6。
- 网络攻击能力被门控:ExploitBench 满分 100,Astra 达到 Preparedness Framework 的 Critical 门槛,高级防御工作流走 Trusted Access / Daybreak Blue 通道。
- 分波发布:9 月 3 日「限量客户优先」疑似意外泄露,24 小时后正式发布并开放 API。
核心疑问:价格是 Sol 的 2.5 倍,「完成工作」的承诺是否只在手动调高推理档时成立?
「Infra」频道最新
- 4GB 显存硬跑 MiniMax H3 视频生成:修好模糊手部要 6 小时渲染一集 — unbenannt1 · 2026-09-08
- Celesto AI 推出 PB 级持久工作区,解决 Agent 沙盒存储难题 — aniketmaurya · 2026-09-08
- Nvidia 持股买芯片的公司达 990 亿美元,循环投资遭质疑 — GaryMarcus · 2026-09-08
- RX 7900 GRE 混搭十年前的 RX 480,双卡推理提速 36% — tabletuser_blogspot · 2026-09-08
- OpenAI 图表外推:9-12 个月内超 25% 算力将用于 agent 推理 — joshua_clymer · 2026-09-08
- 用户在 DGX Spark 上跑 Pinokio 部署 Wan2GP、MiniMax H3 等模型 — cocktailpeanut · 2026-09-08