GPT-5.6实测翻车出现身份混淆,Claude Opus 5编码胜出

一位开发者对比测试了 GPT-5.6 Sol 与 Claude Opus 5 在自主使用应用与编码方面的能力。结果显示 GPT-5.6 出现了逻辑断裂与严重的幻觉,甚至在完成任务后误认自己是 Claude。相比之下,Claude Opus 5 展现了更高维度的理解力与更优的编码表现,凸显了两款模型在计算机控制能力上的差距。

2026-08-11 ~ 2026-08-11 · 3 条相关