博主实测 GPT-6.1 Sol 全档推理力度,Astra 更快但更贵
PawelHuryn · x · 2026-10-01
博主 PawelHuryn 在自己的基准测试网站公布了 GPT-6.1 Sol 各推理力度档位(effort levels)的成绩,其中 max 和 xhigh 档跑 3 次(n=3),其余档位跑 2 次,追加的 n=3 运行仍在进行。
与 Astra 对比:Astra 价格明显更高,但在最具挑战性的任务上速度更快、所需轮次(turns)更少。具体分数、注意事项及更多模型可查看其网站的实时榜单。
所属事件:GPT-6.1 Sol 多项实测出炉:性能近 Astra、成本大幅更低(16 条相关)→
「模型」频道最新
- Reddit 讨论:本地模型做 Blender 建模仍然力不从心 — Any-Lingonberry7411 · 2026-10-01
- Rox 实测:Jev 重排检索比 GPT-5 Mini 快 20 倍、便宜 10 倍 — hardimanjames · 2026-10-01
- Nat Lambert 谈 Gemini 4:更多前沿实验室竞争是好事 — natolambert · 2026-10-01
- Qwen3.8-Flash-Next 砍掉 44% 专家,Terminal-Bench 达 70% — rmonsurate · 2026-10-01
- Google 发布 Gemini 4 Argon:专攻网络安全,prompt 注入防御登顶 — ralucaadapopa · 2026-10-01
- 模型大战有多疯狂:OpenAI 一周内从全球第一滑落至第三 — signulll · 2026-10-01