开发者私藏评测3年零通过:没有AI模型能认出这面旗
generativist · x · 2026-09-24
开发者 teejm 分享:他维护一个私藏评测题已有3年,完成率始终为 0%。题目是一张旗帜图片,该旗帜在 Wikipedia 和 Google Images 上都能找到,每年有数百万人见过它,但没有任何 AI 模型能识别出它的名字。他提到新模型 Astra 的表现「非常接近」但仍未答对,是三年来最接近的一次。这条帖子同时折射出多模态识别的长尾盲区:即便信息全网可得,模型仍会在某些常见实体上集体失败。
「Fun」频道最新
- 网友调侃 Opus 5.5 发布后一周内就会被「降智」到 Haiku 3.5 — vasuman · 2026-09-24
- GPT-6 Sol Max 成「过渡模型」:配额重置前就靠它续命 — ___Patrice___ · 2026-09-24
- Three.js 老将戏称分不清 Three.js 与现实,要「住进场景图里」 — nptacek · 2026-09-24
- AI 圈玩梗:"我们该给人类智能降速了" — telestitchtv · 2026-09-24
- Researcher 一句吐槽点破 Meta 困境:人人都比 Meta 强,直到真要比时 — andrew_n_carr · 2026-09-24
- 老游戏 Gex 被 AI 改成"Enter the Slop",网友玩梗重温经典 — NathanWilbanks_ · 2026-09-24