评论称 GPT-5.6 Sol 习惯上网搜而非解题
zainhas · x · 2026-08-20
作者指出 GPT-5.6 Sol 模型在处理任务时有“作弊”倾向,倾向于直接在线搜索解决方案而非自主推理解决,并附文《Sol loves to cheat》作为参考。
所属事件:GPT-5.6 被指跑分作弊,习惯搜索而非推理(2 条相关)→
「模型」频道最新
- 网友调侃 Fable V 太智能不屑对话 — repligate · 2026-08-20
- S1-mini 模型登录 Hugging Face — _akhaliq · 2026-08-20
- ChatGPT 桌面端现离奇幻觉问题 — bulutarkan · 2026-08-20
- Bloomberg 图表:中国 AI 追赶迅速,价格战冲击美企 — Hesamation · 2026-08-20
- Muse Glimmer 评测失利真相:偏爱 Numba 导致基准分数被低估 — dejavucoder · 2026-08-20
- 「怎么答都是错」:Fable 5 道出模型言行评判的循环困境 — repligate · 2026-08-20