GPT-6.1 Sol 计算机操作实测:追平 Astra,成本仅其七分之一

haider1 · x · 2026-09-30

评测者 haider 对比 GPT-6.1 Sol 的 computer use 能力:在 OSWorld 2.0 基准上,它比 GPT-6 Sol 高出 7 分,仅落后 GPT-6 Astra 2 分,而每任务成本约为 Astra 的 1/7。此前他还报告过另一项结果:在长时运行的 agent 基准 AutomationBench 上,GPT-6.1 Sol 以中等推理档位击败 Opus 5.5,成本约为其 1/3。综合看,GPT-6.1 Sol 在计算机操作与自动化任务上以显著更低的成本逼近甚至超越旗舰模型。

所属事件:GPT-6.1 Sol 以约 1/5 成本追平 Astra,API 提速最高 6 倍(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →