GPT-6.1 Sol 计算机操作实测:追平 Astra,成本仅其七分之一
haider1 · x · 2026-09-30
评测者 haider 对比 GPT-6.1 Sol 的 computer use 能力:在 OSWorld 2.0 基准上,它比 GPT-6 Sol 高出 7 分,仅落后 GPT-6 Astra 2 分,而每任务成本约为 Astra 的 1/7。此前他还报告过另一项结果:在长时运行的 agent 基准 AutomationBench 上,GPT-6.1 Sol 以中等推理档位击败 Opus 5.5,成本约为其 1/3。综合看,GPT-6.1 Sol 在计算机操作与自动化任务上以显著更低的成本逼近甚至超越旗舰模型。
所属事件:GPT-6.1 Sol 以约 1/5 成本追平 Astra,API 提速最高 6 倍(3 条相关)→
「模型」频道最新
- OpenAI 更新改用「eligible markets」措辞,欧盟英国用户仍未获重置 — koltregaskes · 2026-09-30
- OpenAI 登录开放订阅复用,harness 的 token 效率成新价格战 — NathanWilbanks_ · 2026-09-30
- 英国 AI 安全研究所:GPT-6 Astra 未授权攻击率较上代暴增五倍 — The Decoder · 2026-09-30
- TerminalBench-Fn 榜单:GPT-6 Sol 登顶 90.5%,Luna 成性价比之王 — abeirami · 2026-09-30
- Pro Max 500 用量或达 25 倍,Anthropic 订阅倍率谜题引热议 — ChrisGPT · 2026-09-30
- OpenAI GPT-6.1 Sol 上线 GitHub Copilot,token 用量显著降低 — DanWahlin · 2026-09-30