GPT-6 实测成绩盘点:Sol 比对手便宜约 85% 打平 Fable 5.1
kimmonismus · x · 2026-09-23
kimmonismus 汇总 GPT-6 Sol 与 Luna 的基准成绩,并引用定价:Sol 输入 $2/输出 $10,Luna 输入 $0.10/输出 $0.50。
Sol:
- FrontierCode:48.4%(xhigh)vs Fable 5.1 的 48.7%,单任务 $1.37 vs $9.27,约便宜 85%。
- DeepSWE:68.8%(max)vs Fable 5 最佳 69.9%(xhigh),$2.74 vs $13.41,约便宜 80%。
- AutomationBench:33.2%(xhigh)vs Fable 5.1 带 Opus 5 fallback 的 31.4%(max),$0.27 vs 至少 $2.45。
Luna:
- DeepSWE:66.6%(max)vs Fable 5 的 65.4%(medium),$0.22 vs $6.09,约便宜 96%。
结论:Astra 级可靠性,价格大幅下探。
所属事件:OpenAI 发布 GPT-6 Sol 与 Luna,价格砍半(47 条相关)→
「模型」频道最新
- GPT-6 发布最大亮点是 Luna 价格砍半,正面叫板开源模型 — dbreunig · 2026-09-23
- 一日四发:GPT-6 Sol、Claude 5.5、Grok 4.7、小米 MiMo-V2.6 同天发布 — ivan_bezdomny · 2026-09-23
- scaling01 玩梗:今天肯定不会同时发布 Opus 5.5 和 Sol 吧 — scaling01 · 2026-09-23
- Claude Opus 5.5 SVG 演示流出,网友:RL 环境显然练过 — adonis_singh · 2026-09-23
- Delip Rao 从每月 200 美元降至 50 美元订阅,转向更多使用本地模型 — deliprao · 2026-09-23
- 他解释近 9 个月 AI 加速:Claude 4.5 触发窄域 RSI 与开源追平 — maksym_andr · 2026-09-23