博主实测各家 AI 订阅性价比并更正基准
博主 Paweł Huryn 用自建 Bug Hunt Benchmark(2 个仓库、105 个连 2026 年初前沿模型都未发现的 bug)实测各家订阅计划的真实 API 价值。结果显示 Opus 5.5 逼近 Fable 5.1,GPT-6.1 Sol 便宜 10 倍;Grok 和 Muse 的低价套餐即可胜任真实 Agent 任务,$30/月的 SuperGrok 与 $15/月的 Muse 套餐就够用。他随后更正了 Claude 订阅额度测试,撤下 Max 5x 档位数据,因 Anthropic 宣称的「最高 20 倍用量」仅限 5 小时窗口。
2026-10-02 ~ 2026-10-02 · 3 条相关
- 实测结论:$30 SuperGrok、$15 Muse 低价套餐就够跑真实 Agent 任务 — PawelHuryn · 2026-10-02
- 实测算账:Opus 5.5 逼近 Fable 5.1,GPT-6.1 Sol 便宜 10 倍 — PawelHuryn · 2026-10-02
- Anthropic「最高 20 倍用量」仅限 5 小时窗口,博主更正 Max 5x 基准 — PawelHuryn · 2026-10-02