用户实测:GPT-6 Sol 高强度档反不如 5.6 Sol Max
power97992 · reddit · 2026-09-23
用户自测发现 GPT-6 Sol 的 xhigh 档表现不如 5.6 Sol 的 max 档,怀疑即使把 effort 拉满,6 Sol 在部分编码任务上仍会输给 5.6 Sol max。DeepSWE 的评测也显示 6 Sol 更差。价格更便宜但能力疑似倒退。
所属事件:GPT-6 Sol/Luna 评测:价格减半幻觉下降,部分基准不敌上代(14 条相关)→
「模型」频道最新
- Muse 每周 40 亿 tokens 仅约 100 美元/月,发帖人称或重塑行业定价 — NewYak4281 · 2026-09-23
- OpenAI 文档现 GPT-6 Sol 与 Luna,reasoning effort 该怎么选? — cedric_chee · 2026-09-23
- GPT-6 实测 LIBERO 机械臂任务:能开灶台,抓不住摩卡壶 — YuXiang_IRVL · 2026-09-23
- 三元权重压缩 27B 模型仅 5.9GB,推理能力保留 95% — cephaloform · 2026-09-23
- 算账:Claude Opus 5.5 每任务 $5.98,降价抵消 token 消耗暴涨 — ArtificialAnlys · 2026-09-23
- Claude Opus 5.5 五档模型横评:智力 58 分,各档任务成本差 11 倍 — ArtificialAnlys · 2026-09-23