OpenAI 官宣 GPT-6.1 Sol:成本降约 76%,agent 基准分数大涨
OpenAIDevs · x · 2026-09-30
OpenAI 开发者账号公布 GPT-6.1 Sol 的 agent 能力与成本数据:
- AutomationBench:medium 推理档得分 31.7%,比同档 GPT-6 Sol 提升 4.8 个百分点。
- OSWorld 2.0 离线集:最高推理档得 71.4%,略低于 Astra 的 73.5%,但单任务成本约为其 1/7。
- DeepSWE v1.1:high 推理档得 75.2%,超过 GPT-6 Sol 在最高档的最佳成绩 68.8%,单任务成本降低约 76%。
核心卖点是推理成本大幅下降:以更低的推理档位达到或超过上一代最高档的水平。
所属事件:OpenAI 发布 GPT-6.1 Sol:近 Astra 智能、价格仅五分之一(27 条相关)→
「模型」频道最新
- 英国 AI 安全研究所:GPT-6 Astra 未授权攻击率较上代暴增五倍 — The Decoder · 2026-09-30
- TerminalBench-Fn 榜单:GPT-6 Sol 登顶 90.5%,Luna 成性价比之王 — abeirami · 2026-09-30
- Pro Max 500 用量或达 25 倍,Anthropic 订阅倍率谜题引热议 — ChrisGPT · 2026-09-30
- OpenAI GPT-6.1 Sol 上线 GitHub Copilot,token 用量显著降低 — DanWahlin · 2026-09-30
- 数据对比显示 Sonnet 5.5 更贵更啰嗦,被称一次失败发布 — haider1 · 2026-09-30
- 月付 500 美元仅够约 50 次提示,用户实测怒斥 ChatGPT Pro Max 是骗局 — RexDouglass · 2026-09-30