多模态模型识图翻车:GPT 视觉能力落后于 Opus 与 Gemini
stevejuniormc · reddit · 2026-08-09
一名用户测试了主流大模型在低质量图片中识别鸟类的视觉能力。
测试结果
- Claude 3.5 Opus、Fable 5 和 Gemini 3.6 Flash 均成功识别。
- GPT 5.6 sol 版本的识别结果则完全偏离目标,表现出在特定视觉任务上的不可靠性。
「模型」频道最新
- OpenAI 削减 Codex 上下文至 272k,被指为规避缓存读取成本 — SquirrelMotor5379 · 2026-08-10
- 以少胜多:月之暗面仅凭数百人打造出前沿模型 Kimi — OwainEvans_UK · 2026-08-10
- Mistral 推出 Shieldstral:3B 参数的开源安全分类器 — dl_weekly · 2026-08-10
- Google SDK 代码泄露,意外曝光 Gemini 4 Flash — Rare_Bunch4348 · 2026-08-10
- OpenAI 模型幻觉率高达 93%,AI 商业化面临成本与可靠性考验 — gerardsans · 2026-08-10
- Anthropic战略剖析:专注B2B编码模型,拒碰图像生成 — sahilypatel · 2026-08-10