Opus 5.5 在 Terminal-Bench 4.0 上的成本-性能曲线
Ok_Barracuda_1161 · reddit · 2026-09-23
Reddit 用户发布图表,展示 Claude Opus 5.5 在 Terminal-Bench 4.0 基准上的成本与性能关系,与同类模型对比其性价比表现。
所属事件:Claude Opus 5.5 发布即登顶智能指数,降价提速引发热议(50 条相关)→
「模型」频道最新
- 第三方实测:Claude Opus 5.5 出图更精细,成本却是 GPT-6 Sol 的 13 倍 — testingcatalog · 2026-09-23
- 实测者称 Claude Opus 5.5 拥有迄今最佳视觉设计能力 — burny_tech · 2026-09-23
- GPT-6 Sol Codex 系统提示词泄露,全文超 29.4 万字符 — gaganghotra_ · 2026-09-23
- Claude 5.5 被曝持续生成用户回合,模型行为再现异常 — BlackHC · 2026-09-23
- 代码评测多是夹带私货的糊分数,开发者呼吁按领域细分 benchmark — almmaasoglu · 2026-09-23
- 信封上画草图,Grok 4.7 几分钟内做出可玩解谜游戏 Lightweave — luismbat · 2026-09-23