成本 Pareto 领先,输出 token 效率仅次于 Astra
adonis_singh · x · 2026-09-30
博主更新了自己的排行榜配色并展示结果:成本维度上是 Pareto 最优;按输出 token 效率看则仅次于 Astra——在任何 reasoning effort 档位上都低于 Astra,说明在该基准上效率略逊。
所属事件:GPT-6.1-Sol 评测位列第二且成本优势显著(3 条相关)→
「模型」频道最新
- Anthropic 报告:开源 GLM-5.3 漏洞利用能力逼近 Claude,护栏易绕过 — kimmonismus · 2026-09-30
- Terminal-Bench 观察引出新视角:模型失败未必是能力不行 — abeirami · 2026-09-30
- OpenAI 与 Anthropic 新模型发布节奏从约 10 周一款加速到约 11 天 — connoraxiotes · 2026-09-30
- 用户称 GPT-6.1 Sol 实为 Terra 换皮,可用性改善但仍不及 Opus 5.5 — CtrlAltDwayne · 2026-09-30
- Gemma 4 31B 单卡 4090 跑结构化带概率判题,typevet 连收据照片一起核账 — One_Temperature5983 · 2026-09-30
- MentalHealthBench:用真实心理健康对话评测 AI 回应质量 — BraydonDymm · 2026-09-30