开发者实测 Opus 反复重犯同类错误,提示纠错无效
开发者 ivanbezdomny 在一系列实测中发现,Claude Opus(包括 Opus 5.5)会在同类任务上反复犯同样的错误,且明示提示也无法纠正,由此提出应用「生成-批评-重写」的迭代流程替代禁令式指令。
已确认
- 在绘制勺子和叉子时,Opus 反复出现同样的结构错误;即使在初始提示中明确警告、直接指出「你有问题」「侧视图和真实餐具照片对比一下」,模型仍无法理解错在哪,甚至辩称自己没有问题。
- 让 Opus 构建 3D 游戏时,模型在勺子/叉子的侧视建模上犯了物理直觉错误,提示纠正同样无效。作者认为模型带有先验(priors),虽能「搭建 3D 游戏」但并未真正理解物理世界。
- 让 Opus 5.5 设计勺子制造流程时出现一连串明显错误(最显眼的是勺子本身的问题);重开新会话并在初始提示中明确告知要避免这些具体错误后,模型仍做出几乎完全相同的错误设计,只是 UI 换了个更花哨的样式,而用户并不喜欢这种花哨。
- 作者预计从零重新生成第三次,同样的错误大概率还会出现。
为什么重要
- 这组实验说明「在提示词里禁止错误」对当前模型往往无效,微调模型去规避特定错误也不如依赖迭代式纠错。
- 作者由此提出替代方案:先生成初稿,再让模型自我批评并重写来纠错,即用流程设计弥补模型缺乏真实物理理解的短板,对重度依赖 AI 生成内容的开发者有直接参考价值。
2026-10-04 ~ 2026-10-04 · 5 条相关
一手来源
- Opus 画餐具反复犯同样错误,明示提示也纠正不了 — ivan_bezdomny ·
- 让 Opus 5.5 设计制勺流程,警告过的错误它照犯不误 — ivan_bezdomny ·
- 用生成-批评-重写流程替代禁令:让 AI 写作少犯错 — ivan_bezdomny ·
- 用户让 Opus 5.5 设计勺子制造流程,重试后原样复刻错误 — ivan_bezdomny · 2026-10-04
- 【源头】让 Opus 5.5 设计制勺流程,警告过的错误它照犯不误 — ivan_bezdomny · 2026-10-04
- 【源头】Opus 画餐具反复犯同样错误,明示提示也纠正不了 — ivan_bezdomny · 2026-10-04
- 开发者实测:Opus 能做 3D 游戏却分不清勺叉侧视图 — ivan_bezdomny · 2026-10-04
- 【源头】用生成-批评-重写流程替代禁令:让 AI 写作少犯错 — ivan_bezdomny · 2026-10-04