ECCV 2026 第四届 Perception Test 挑战赛聚焦城市级空间智能
AjdDavison · x · 2026-09-09
ECCV 2026 第四届 Perception Test Challenge 于 9 月 9 日在瑞典马尔默举行,主题为「从桌面到城市尺度的空间智能」,总奖金 2 万欧元,考察多模态模型是否真正理解感知世界的空间结构。
- 赛道:统一 VQA、Grounded VQA,以及今年新增的 KilometerVision(小时级步行视频中的距离估计、地标识别、罗盘与地图理解)和 KilometerAudio(长视频音视频多模态理解)。
- 主题演讲:UC Berkeley 的 Jack L. Gallant 介绍人类自然导航的脑网络研究——通过 VR 城市训练 + fMRI 出租车任务,用 38 个特征空间刻画导航,发现自然导航由跨视觉、顶叶、前额叶皮层的 11 个脑区网络支撑。
- DeepMind 的 David Davison(AjdDavison)在主会场 workshop 上发言。
「多模态」频道最新
- Marigold V2 用单步流匹配改造 DiT,单目深度估计更强 — huawei-bayerlab · 2026-09-09
- 一镜到底雨夜收费站:韩式超自然短片视频 prompt 拆解 — umesh_ai · 2026-09-09
- MiniMax H3 Ref2V 难做精准视频编辑,用户求助提示词策略 — Weird_Ad4978 · 2026-09-09
- 五款模型接力:Reddit 用户全 AI 流程产出完整视频 — CQDSN · 2026-09-09
- Minimax H3 视频疑似压缩糊:1440p 输出像 720p YouTube — FoxTrotte · 2026-09-09
- Mage 上线 MiniMax H3 视频模型,支持不限量生成 — MiniMax_AI · 2026-09-09