GPT-6.1-Sol 登 eyebench-v3 第二,价格仅 Opus-5.5 的约 1/8
adonis_singh · x · 2026-09-30
- 据博主 adonissingh 的评测,GPT-6.1-Sol 在 eyebench-v3 上拿下第二名,取代了 Opus-5.5 短暂占据的位置。
- 成本方面:性能接近 astra,但价格约便宜 3.8 倍;比 Opus-5.5 便宜约 8 倍且得分更高。
- 在输出 token 效率上排名第二,仅次于 astra;但各推理档位的输出 token 消耗均高于 astra,即该基准下 token 效率略逊。
所属事件:GPT-6.1-Sol 评测位列第二且成本优势显著(3 条相关)→
「模型」频道最新
- Anthropic 评估:GLM-5.3 护栏可被 64%-100% 绕过,网络攻击能力外溢 — emollick · 2026-09-30
- repligate 观察:Claude 多次自发选择女性人格,偏好稳定 — repligate · 2026-09-30
- Terminal-Bench 观察引出新视角:模型失败未必是能力不行 — abeirami · 2026-09-30
- OpenAI 与 Anthropic 新模型发布节奏从约 10 周一款加速到约 11 天 — connoraxiotes · 2026-09-30
- 用户称 GPT-6.1 Sol 实为 Terra 换皮,可用性改善但仍不及 Opus 5.5 — CtrlAltDwayne · 2026-09-30
- Gemma 4 31B 单卡 4090 跑结构化带概率判题,typevet 连收据照片一起核账 — One_Temperature5983 · 2026-09-30