GPT-6.1 Sol max 比 Opus 5.5 便宜 88%?实测账本揭真相
Wsz2020 · reddit · 2026-10-02
- 作者基于 Artificial Analysis 数据对比 Opus 5.5 与 OpenAI 新模型 GPT-6.1 Sol 的性价比,指出「Sol max 比 Opus 5.5 max 便宜 88%」的表面数字有误导性——因为 Opus 5.5 根本不该开 max 档。
- 公平对比(high 档 vs max 档):Opus 5.5 high 智能指数 54 对 Sol max 52,成本 $1.82 对 $0.72,输出速度约 73 t/s 对 64-66 t/s,首 token 延迟约 39 秒对 273 秒。Opus 每多 1 分约多花 $0.55,月跑 1 万次任务差价约 $11,000。
- 关键发现:Sol 自己的努力阶梯在顶部非常平——high 档得分 50、单任务仅 $0.32,xhigh 得 51,max 只买到了延迟而非智力。结论:在意延迟或要顶级质量选 Opus 5.5 high;批量任务选 Sol max,但很多场景 Sol high 更便宜且能力几乎不降。
「模型」频道最新
- JevBench 将扩充评测:LLM 路由、RAG 检索与内容审核任务 incoming — airesearch12 · 2026-10-02
- 曝谷歌内部模型 Argon:20 万员工日常实测 — Zergylord · 2026-10-02
- 号称欧盟首个系统一模型 JEV 上线,主打欧洲本地托管 — juanviera23 · 2026-10-02
- Gemini 莫名说出用户母亲真名,被追问后三次改口解释 — Exact_Firefighter864 · 2026-10-02
- GPT-6.1 Sol 以四分之一价格逼近 Astra,成本性价比飞速提升 — danielmckinn0n · 2026-10-02
- PostTrainBench v1.2 出新结果,后训练能力榜更新 — mariofilhoml · 2026-10-02