GPT-6.1 Sol 实测:xhigh 档性价比最佳,medium 退化明显
aitrendz_xyz · x · 2026-10-05
日本开发者用 Terminal-Bench 4.0 实测了 GPT-6.1 Sol 的不同推理档位(xhigh/high/medium),并结合 Codex 对比 Astra 和 Opus 5.5。
- 官方基准看似 high 最强,但自测发现 xhigh 已到性能上限,high 之后收益封顶
- xhigh 成本与 high 相差不大,性价比最优,推荐 xhigh
- medium 退化幅度比预期大,不建议
- 绝对成绩仍落后 Astra 和 Opus 5.5,但价格便宜一个量级
结论:GPT-6.1 Sol 是性价比极高的编码模型选择。
「模型」频道最新
- Anthropic 新模型「Argon」内部代号曝光,或提前到来 — lyraxana · 2026-10-06
- 为何 Anthropic 不做图像模型:用代码代替像素生成 — Kyrannio · 2026-10-06
- OpenAI 公布 ChatGPT 文本水印方案,以符合欧盟溯源新规 — rhiever · 2026-10-06
- 让模型经营公司一年:Opus 5.5 花两小时找出漏洞刷小游乐设施 — dylan_ebert_ · 2026-10-06
- Cohere 发布 Embed 5 Pro/Fast,每百万 token 仅 0.12/0.08 美元 — dl_weekly · 2026-10-06
- Elo 评分失效,作者改用迁移频率归一化给模型排名 — cloneofsimo · 2026-10-06