曝 GPT-6 Sol 机器人任务成绩达 GPT-5.6 的 1.6 倍且便宜 47%
ycombinator · x · 2026-09-25
一则评测爆料称 GPT-6 Sol 在机器人任务上得分是 GPT-5.6 Sol 的 1.6 倍、成本低 47%,但在 Opus 5.5 的 Pareto 前沿之下,即性价比并非最优。消息未经官方证实,真实性待观察。
「模型」频道最新
- Opus 5.5 一条提示词复刻 Minecraft:1 小时约 20 美元搞定 — amasad · 2026-09-25
- 用户实测:Opus 新版 Medium 推理档表现佳,High 反显多余 — rudrank · 2026-09-25
- PINNACLE 评测:GPT-6 Sol 拉满思考力错误降 2.5 倍,Claude Opus 5.5 无效 — ryanshrout · 2026-09-25
- 4B 开源小模型登顶 JevBench,靠更快更便宜击败大模型 — airesearch12 · 2026-09-25
- Terminal-Bench-Science 榜单上线:GPT-6 Astra 与 Claude Opus 5.5 领跑 — scaling01 · 2026-09-25
- 用户晒 Opus 5.5 文风进化:终于能删掉「别写得像二货」自定义指令 — generativist · 2026-09-25