GPT-6 Sol 在 AutomationBench 得分 33.2%,成本仅 Opus 5 约 1/11
141_1337 · reddit · 2026-09-23
Reddit 用户晒出跑分图:GPT-6 Sol 在 AutomationBench 基准上取得 33.2% 的成绩,超过 Opus 5,同时每个任务的成本约低 11 倍。第三方实测性质,具体榜单细节以图中数据为准。
「模型」频道最新
- 一天连发四款新模型,开发者断言:模型已商品化,钱将流向硬件与应用 — xiaosun86 · 2026-09-23
- 普通用户吐槽 ChatGPT 20 美元订阅额度不够做个 PPT — Namnagort · 2026-09-23
- 开发者称 Anthropic 禁止 Claude Code 订阅用于 OpenClaw 后失去人心 — granawkins · 2026-09-23
- 开发者吐槽 API 账单失控:项目跑超后收到天价消耗账单 — daluoseo · 2026-09-23
- 用户用 Claude Opus 5.5 数分钟生成 Pitfall 风格像素动画小游戏 — technollama · 2026-09-23
- Claude Opus 5.5 写出 35.5 倍加速内核,碾压 GPT-6 Astra 纪录 — scaling01 · 2026-09-23