博主实测各家 AI 订阅性价比并更正基准

博主 Paweł Huryn 用自建 Bug Hunt Benchmark(2 个仓库、105 个连 2026 年初前沿模型都未发现的 bug)实测各家订阅计划的真实 API 价值。结果显示 Opus 5.5 逼近 Fable 5.1,GPT-6.1 Sol 便宜 10 倍;Grok 和 Muse 的低价套餐即可胜任真实 Agent 任务,$30/月的 SuperGrok 与 $15/月的 Muse 套餐就够用。他随后更正了 Claude 订阅额度测试,撤下 Max 5x 档位数据,因 Anthropic 宣称的「最高 20 倍用量」仅限 5 小时窗口。

2026-10-02 ~ 2026-10-02 · 3 条相关