实测多模态大模型玩地理盲猜:速度不及人类专家

HanchungLee · x · 2026-08-04

开发者测试了多个多模态大模型在地理盲猜任务上的表现。此前 Gemini 和其他模型因被地名误导而严重翻车。最新测试显示,5.6 版本的模型在结合两次地理定位和浏览器控制后,耗时 10 分钟成功解题,展现出强大的多模态推理与工具调用能力,但速度仍远逊于能在 3 分钟内完成的人类专家。

所属事件:多模态大模型地理盲猜翻车(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →