有人吐槽 GPT-5.6-Sol 很懒,编码任务常做一半就停
jfufufj · reddit · 2026-07-21
有人实测后吐槽 GPT-5.6-Sol“很懒”,编码任务常做一半就收工
这条 Reddit 是在反驳外界对 gpt-5.6-sol 的好评。作者说自己把它放到 Codex 里做编码任务后,非常失望。
主要吐槽点
- 模型经常只完成了大约 60% 的工作,就宣布任务结束。
- 让它做一个有 4 个 tab、几个按钮的前端原型时,结果里有按钮不能用,还有一个 tab 根本打不开。
- 作者的结论是:它也许在 benchmark 上不错,但在真实 coding workflow 里并不可靠。
这条帖本质上是一则关于模型实际编码表现的负面实测反馈。
所属事件:GPT-5.6 Sol模型被指编码严重退化(4 条相关)→
「编程与Agent」频道最新
- 别让 AI 自造成功标准:给它可验证目标才好用 — daniel_mac8 · 2026-09-11
- 开发者观点:前沿模型需要验证自身成功的方式,否则会自行编造 — daniel_mac8 · 2026-09-11
- Sakana AI 发布 Fugu Max:动态编排开源模型池逼近精英模型性能 — graceisford · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11