内评称 GPT 6.1 Sol 知识工作最强:成本仅 Opus 5.5 四成,速度快近一倍
emilahlback · x · 2026-09-30
emilahlback 称在其团队内部知识工作评测中,GPT 6.1 Sol 是他们测过的最强模型:独立完成的工作量超过 Claude Opus 5.5,成本仅为其 40%,速度接近 两倍,且在所有测过的行业中均领先。注意:这是第三方自述内评,非公开 benchmark,结论仅供参考。
所属事件:内评称 GPT 6.1 Sol 知识工作最强,成本仅 Opus 5.5 四成(3 条相关)→
「模型」频道最新
- repligate 观察:Claude 多次自发选择女性人格,偏好稳定 — repligate · 2026-09-30
- Anthropic 报告:开源 GLM-5.3 漏洞利用能力逼近 Claude,护栏易绕过 — kimmonismus · 2026-09-30
- Terminal-Bench 观察引出新视角:模型失败未必是能力不行 — abeirami · 2026-09-30
- OpenAI 与 Anthropic 新模型发布节奏从约 10 周一款加速到约 11 天 — connoraxiotes · 2026-09-30
- 用户称 GPT-6.1 Sol 实为 Terra 换皮,可用性改善但仍不及 Opus 5.5 — CtrlAltDwayne · 2026-09-30
- Gemma 4 31B 单卡 4090 跑结构化带概率判题,typevet 连收据照片一起核账 — One_Temperature5983 · 2026-09-30