GPT-6 Sol 与 Opus 5.5 低档推理:1/4 价格 4 倍速逼近上代中档性能
that_90s_guy · reddit · 2026-09-23
Reddit 帖引用 artificialanalysis.ai 数据指出,GPT-6 和 Opus 5.5 的最大变革不是性能上限,而是速度与成本:低推理档(low reasoning)模型以约 1/4 价格、4 倍速度接近上一代中档推理的性能。
关键数据:
- GPT-6 Sol(low):智力指数 34,每任务 $0.13,27.75s(对照 medium:40,$0.25,59.99s)
- Claude Opus 5.5(low,fallback):指数 42,$0.55,81.35s(对照 medium:51,$1.34,206.07s)
- 上一代对照:GPT-5.6 Sol(medium)39,$0.50,125s;Claude Opus 5(medium)45,$2.19,320.93s
结论:前沿 agent 级性能已进入预算价位,单任务成本与耗时的下降曲线意味着 agent 大规模运行的性价比拐点正在到来。
「模型」频道最新
- Reddit 用户怒斥 GLM 榜单成绩是谎言:实际体验远逊 Qwen 与 DeepSeek — Thin_Pollution8843 · 2026-09-23
- Artificial Analysis 推出 9 语言 TTS 榜单,Cartesia Sonic 拿下 8 项第一 — davidwromero · 2026-09-23
- gleech 补充:行为审计干净不等于未来六个月不会出格 — gleech · 2026-09-23
- Anthropic 行为审计:Claude Opus 5.5 对齐表现为近期 Claude 最佳 — gleech · 2026-09-23
- Opus 5.5 纯代码画出奔腾马:单 HTML 文件,逆运动学驱动马腿 — victormustar · 2026-09-23
- 网友称 GPT-6 全系模型配合超长提示词效果更佳,未获证实 — BLUECOW009 · 2026-09-23