对比:Claude比GPT-5.5更懂倒拿书的梗
Sauers_ · x · 2026-07-07
@Sauers用一个“孙子倒拿书假装在奶奶面前阅读”的幽默情境对比测试两个模型:Claude正确指出幽默来自于孙子自以为骗过了奶奶、而观众知道这很可笑;而GPT-5.5错误地把“倒拿书”当作观众识破他在假装阅读的证据(实际上无论正拿倒拿,观众从前文设定已知他在假装)。
该对比展示了两个模型在多模态幽默理解与推理上的行为差异。
所属事件:GPT-5.5基础阅读测试接连输给Claude(3 条相关)→
「模型」频道最新
- 泄露表格显示 Gemini 3.6 Flash 降价又提分 — xiaohu · 2026-07-21
- Gemini 3.6 Flash 的关键还是效率 — Angaisb_ · 2026-07-21
- Google 发布三款 Gemini 模型,含最强版和安全版 — nordicinst · 2026-07-21
- Gemini 界面疑似先上了 3.6 Flash,3.5 Pro 还没等到 — xiaohu · 2026-07-21
- 故意否定第一版答案,能逼 GPT 和 Gemini 吐出更多漏洞 — huangyun_122 · 2026-07-21
- Benchmark 差距可能低估了 Ant 模型的能力宽度 — gleech · 2026-07-21