爆料称 GPT-6 Sol 在编码与调试任务上不敌 5.6 Sol
ns123abc · x · 2026-09-23
有用户爆料称(未证实),GPT-6 Sol 在 DeepSWE、computer use 和 research debugging 上确认比 5.6 Sol 更差,在网络安全任务上也没有提升;其优势在于更便宜、更高效,但并不是一个更聪明的模型。
所属事件:GPT-6 Sol/Luna 评测:价格减半幻觉下降,部分基准不敌上代(14 条相关)→
「模型」频道最新
- Muse 每周 40 亿 tokens 仅约 100 美元/月,发帖人称或重塑行业定价 — NewYak4281 · 2026-09-23
- OpenAI 文档现 GPT-6 Sol 与 Luna,reasoning effort 该怎么选? — cedric_chee · 2026-09-23
- GPT-6 实测 LIBERO 机械臂任务:能开灶台,抓不住摩卡壶 — YuXiang_IRVL · 2026-09-23
- 三元权重压缩 27B 模型仅 5.9GB,推理能力保留 95% — cephaloform · 2026-09-23
- 算账:Claude Opus 5.5 每任务 $5.98,降价抵消 token 消耗暴涨 — ArtificialAnlys · 2026-09-23
- Claude Opus 5.5 五档模型横评:智力 58 分,各档任务成本差 11 倍 — ArtificialAnlys · 2026-09-23