用户实测:GPT 6 系列偷懒摆烂,5.6 版却肯花数小时做质检
jdjohnson · x · 2026-10-01
- 用户 jdjohnson 反馈 GPT 6 系列在长任务中频繁出现「偷懒 + 判断差」的问题。
- 对比之下,GPT Sol 5.6 非常较真:让它把大纲转成 Keynote 演示并匹配其设计系统时,会主动找到对应 skill,并循环数小时做 QA 保证设计一致——虽然浪费但结果正确。
- 而 Sol/Astra 6 则会自己随手造一套设计系统,输出一个粗糙的 PDF 就交差,「又懒又错」。
「模型」频道最新
- 元素名抢注大战:Neon 和 Argon 已被拿下,Krypton 花落谁家? — tkipf · 2026-10-01
- 传 Gemini 4 Argon 初期仅面向 Ultra 订阅用户开放 — opmgyhx · 2026-10-01
- 学者质疑:模型无提示复现视频梗中免责声明,难道不是理解? — technollama · 2026-10-01
- 和 LLM 聊数理像与「偏科天才」合作:会解题却缺大局观 — burny_tech · 2026-10-01
- 博主一句话评价:GPT-6.1 Sol 被低估了 — mallow610 · 2026-10-01
- 「最便宜的模型其实是Opus 5.5」:省人时才是真成本 — CamBrazy3 · 2026-10-01