实测算账:Opus 5.5 逼近 Fable 5.1,GPT-6.1 Sol 便宜 10 倍
PawelHuryn · x · 2026-10-02
Paweł Huryn 用自建 Bug Hunt Benchmark(2 个仓库、105 个 2026 年初前沿模型都没发现的 bug)实测各家订阅计划的真实 API 价值:
模型表现
- Opus 5.5 明显强于 Opus 5,接近 Fable 5.1(41.7 vs 43),但成本仅三分之二($58.53 vs $87.18);作者建议除非预算无限,别再用 Fable 5.1
- Sonnet 5.5 输入/输出价为 Opus 5.5 一半($2/$10 vs $4/$20 每 MTok),但长 Agent 会话主要成本在缓存读取,两者同为 $0.20/MTok;Sonnet 5.5 (max) 以 51.3/105 拿下第一(跑 1497 轮)
- GPT-6.1 Sol 略强于 GPT-5.6 Sol 且复杂任务总成本低 10 倍以上(输入输出减半、缓存读取 1/4,官方称 95% 折扣可能是暂时的);10 倍差距主要来自轮数(200 vs 485)
订阅性价比
- 与 OpenAI/Anthropic 不同,xAI 的小额套餐即可干真实 Agent 工作:SuperGrok $30/月、Muse $15/月,SuperGrok 还含 Grok Bot
- 发布当天 GPT-6.1 Sol 比 Opus 5.5 慢近 2 倍,OpenAI 的 Tibo 称随后几小时会提速
所属事件:Bug Hunt 基准实测各家订阅套餐性价比(2 条相关)→
「模型」频道最新
- GPT-6.1 Sol 以四分之一价格逼近 Astra,成本性价比飞速提升 — danielmckinn0n · 2026-10-02
- PostTrainBench v1.2 出新结果,后训练能力榜更新 — mariofilhoml · 2026-10-02
- 用户吐槽 Opus 5.5 high 档太费:周额度两天就用光 — rudrank · 2026-10-02
- VLM Run 发布 SystemOne API:单次前向返回带概率的类型化答案 — spillai · 2026-10-02
- 文档分类实测:VLM 比 OCR 方案节省约 7 倍 token — spillai · 2026-10-02
- ChatGPT Pro 用户投诉:$200 额度过夜清零、3.2 万 credits 凭空消失 — CedricMakes · 2026-10-02