GPT-5.5小学阅读理解题翻车
Sauers_ · x · 2026-07-07
称 GPT-5.5(但 Claude 不会)在一道小学难度的阅读理解题上答错,反映出模型在基础阅读理解上的行为差异。
所属事件:GPT-5.5基础阅读测试接连输给Claude(3 条相关)→
「模型」频道最新
- Gemini 3.6 Flash 的关键还是效率 — Angaisb_ · 2026-07-21
- Google 发布三款 Gemini 模型,含最强版和安全版 — nordicinst · 2026-07-21
- Gemini 界面疑似先上了 3.6 Flash,3.5 Pro 还没等到 — xiaohu · 2026-07-21
- 故意否定第一版答案,能逼 GPT 和 Gemini 吐出更多漏洞 — huangyun_122 · 2026-07-21
- Benchmark 差距可能低估了 Ant 模型的能力宽度 — gleech · 2026-07-21
- 多款前沿大模型生成红色法拉利 SVG 效果横评 — Able-Line2683 · 2026-07-21