同价对比:GPT-6 Sol 每美元得分更高,Sonnet 5.5 上限更强
AMBNNJ · reddit · 2026-09-29
Reddit 用户用 Artificial Analysis 数据对比 GPT-6 Sol 与 Sonnet 5.5(均为 $2/$10 每百万 token),发现两者单任务成本差异来自 token 消耗:
- 约 $0.55/任务:Sol xhigh 得分 44,Sonnet 5.5 medium 得 41
- 约 $1.07/任务:Sol max 得 48,Sonnet 5.5 high 得 47
- 更高预算下 Sol 没有更高档位;Sonnet 5.5 xhigh 达 52($2.74)、max 达 56($7.60),但高分主要靠烧更多 token(high→max 多花约 7 倍成本换 9 分)
结论:在两者重叠的预算区间 Sol 性价比更高;但 Terminal-Bench 4.0(max effort)上 Sonnet 5.5 以 63.6% 大幅领先 Sol 的 43%。注意 Sonnet 5.5 刚发布,xhigh 数据点来自第三方转述。
「模型」频道最新
- Emulate-1 模型宣称过 Pangram 检测,输出被判为人类写作 — alejandroll10 · 2026-09-29
- AI 安全界激辩思维链监控:读到日记的模型可能学会写假日记 — repligate · 2026-09-29
- Swift 1.5 + HyperQwen:RTX 3090 上任务耗时降 37%、跑出 100+ tok/s — KingGongzilla · 2026-09-29
- Anthropic 员工提醒:别把 Sonnet 拉满 effort,该用 Opus — edwinarbus · 2026-09-29
- Claude 官方再晒 Sonnet 5.5 实验:同一 prompt 弹球物理对比测试 — claudeai · 2026-09-29
- 对比图:Sonnet 5.5 各档努力度都有更便宜的 Sol/Opus 替代 — OnAGoat · 2026-09-29