GPT-5.5基础阅读测试接连输给Claude

多位用户用小学、中学阅读理解题及“倒拿书假装阅读”的笑话情境测试发现,GPT-5.5连续出现误答,而Claude能给出正确解释。这些对比引发讨论:前沿模型在基础文本理解和幽默把握上仍可能出现明显行为差异。

2026-07-07 ~ 2026-07-07 · 3 条相关

另有 1 条近重复转述:Sauers_