GPT-6 Sol 复杂任务弱于 5.6 Sol,胜在成本与效率
FalconsArentReal · reddit · 2026-09-23
- Reddit 用户发帖称,实测显示 GPT-6 Sol 在复杂任务上表现弱于上一代 5.6 Sol,但在成本和效率上占优(附对比截图)。
- 属用户侧初步对比观察,非官方评测,新一代未必全面碾压上代的现象值得关注。
所属事件:GPT-6 Sol/Luna 评测:价格减半幻觉下降,部分基准不敌上代(14 条相关)→
「模型」频道最新
- Muse 每周 40 亿 tokens 仅约 100 美元/月,发帖人称或重塑行业定价 — NewYak4281 · 2026-09-23
- OpenAI 文档现 GPT-6 Sol 与 Luna,reasoning effort 该怎么选? — cedric_chee · 2026-09-23
- GPT-6 实测 LIBERO 机械臂任务:能开灶台,抓不住摩卡壶 — YuXiang_IRVL · 2026-09-23
- 三元权重压缩 27B 模型仅 5.9GB,推理能力保留 95% — cephaloform · 2026-09-23
- 算账:Claude Opus 5.5 每任务 $5.98,降价抵消 token 消耗暴涨 — ArtificialAnlys · 2026-09-23
- Claude Opus 5.5 五档模型横评:智力 58 分,各档任务成本差 11 倍 — ArtificialAnlys · 2026-09-23